Fable 5 mematikan bantuan biologis kurang sering: switch ke Opus 5 telah menjadi lebih sedikit

21 Agustus 202618 tampilan

Anthropic telah memperbaiki keamanan biologis model ini, mengurangi positif palsu dalam pengujian sekitar 85%. Pengguna sekarang mengalami lebih sedikit switch ke model kurang mampu pada kesehatan rutin dan pertanyaan biologi, sementara topik sensitif tetap terbatas.

Fable 5 mematikan bantuan biologis kurang sering: switch ke Opus 5 telah menjadi lebih sedikit

Apa yang berubah

Anthropic telah mengumumkan pembaruan besar untuk keamanan biologis dari lima model Fable. Sebelumnya, sistem akan sering secara keliru memblokir permintaan biologis dan mengarahkan mereka ke versi yang kurang kuat Opus 5. Sekarang, menurut perusahaan, jumlah pengalihan tersebut telah turun sekitar 85% di semua antarmuka produk. Ini berarti pengguna biasa akan kurang sering menghadapi penolakan ketika berhadapan dengan topik medis atau pendidikan - misalnya, ketika menafsirkan hasil lab, menganalisis gejala, atau mempelajari biologi dalam pengaturan akademis.

Yang penting, pembaruan juga mempengaruhi lingkup profesional. Dokter dan staf medis lainnya akan dapat lebih banyak dukungan dari Fable 5 ketika mengerjakan tugas klinis, tanpa terganggu oleh "bounces" tiba-tiba ke Opus 5. Untuk perusahaan itu sendiri, ini adalah langkah menuju penggunaan yang lebih alami dari model dalam skenario sehari-hari mana konteks biologis diperlukan tetapi tidak membawa risiko yang serius.

Mengapa biologi dibatasi

Awalnya, Fable 5 diluncurkan dengan hampir lengkap pemblokiran kueri biologis. Ini bukan kecelakaan tapi kompromi yang disengaja: model memiliki kemampuan yang sangat kuat di daerah ini dan dapat mengalahkan para ahli dalam beberapa tugas yang kompleks. Di tangan para aktor jahat, potensi tersebut dapat mempercepat pengembangan senjata biologi - menurut perkiraan Anthropic, peningkatan kemampuan penyerang sangat besar.

Masalahnya adalah bahwa garis antara penggunaan AI yang bermanfaat dan berbahaya dalam biologi sangat kabur. Bahkan mengobati penyakit kadang-kadang memerlukan bekerja dengan senyawa berbahaya: vaksin hidup atau obat-obatan berdasarkan komponen beracun adalah contoh utama. Musuh canggih bisa memanfaatkan ambiguitas ini untuk menyamarkan niat sebenarnya mereka sebagai permintaan penelitian yang tidak berbahaya. Situasi ini semakin memburuk oleh perkiraan dari tahun 2026 penilaian ancaman tahunan dari komunitas intelijen AS: kemajuan dalam biologi dan editing genom sintetis dapat menimbulkan ancaman biologis baru, dan beberapa negara bagian cenderung terus melanjutkan program senjata biologis dan kimia.

Untuk mengurangi risiko, perusahaan membuat pilihan yang disengaja untuk membatasi: model dibuka untuk domain lain, tetapi biologi hampir sepenuhnya ditutup. Keputusan ini hanya menjelaskan - biaya kesalahan dalam dual- penggunaan bola berpotensi bencana.

Bagaimana perlindungan bekerja sekarang

Pada inti sistem terbaru adalah klasifikasi keselamatan - modul AI otomatis yang mendeteksi permintaan untuk melakukan tugas biologis terproteksi atau mengidentifikasi keluaran berbahaya. Ketika seperti pemicu klasifikasi, permintaan secara otomatis dialihkan ke Opus 5, yang kemampuan biologis secara signifikan lebih sederhana.

Mengembangkan klasifikasi akurat adalah tantangan rekayasa yang kompleks. Ini memerlukan perbedaan yang benar antara permintaan yang diperbolehkan dan tidak dapat ditembus, tuning sistem sehingga tidak menghasilkan positif palsu atau tidak terjawab, dan melindunginya terhadap serangan jailbreak. Pada peluncuran, Anthropic menggunakan klasifikasi biologi yang sengaja luas untuk memberikan akses ke Fable 5 lebih cepat, dan hanya kemudian untuk menyelidiki dan memperbaiki perilakunya. Apakah perusahaan memutuskan untuk menunggu untuk lebih canggih perlindungan, rilis umum model akan tertunda oleh minggu atau bahkan bulan.

Apa yang tersisa tidak tersedia

Meskipun peningkatan signifikan, Fable 5 masih mengarahkan ke Opus 5 untuk permintaan jatuh di bawah dual- gunakan kategori. Hal ini berlaku untuk virologi, toksikologi, dan desain molekuler. Oleh karena itu, model belum cocok untuk penelitian biologis profesional atau pengembangan obat - risiko yang bisa digunakan untuk bahaya hanya terlalu tinggi.

Antropik, bagaimanapun, menyatakan bahwa tidak berniat untuk berhenti di sana. Rencananya termasuk menciptakan jalur akses terpercaya ke kemampuan biologis canggih model untuk spesialis berkualitas. Ini akan menutup celah antara keselamatan dan penggunaan AI dalam biodicine tanpa membuka "kotak Pandora" untuk aktor jahat.

Kesimpulan

Pemutakhiran Fable 5 adalah langkah penting untuk menyeimbangkan utilitas praktis dan keamanan. Sedikit positif palsu berarti model menjadi lebih berguna dalam pendidikan, obat-obatan, dan konsultasi sehari-hari. Namun, dual- menggunakan risiko tetap, dan perusahaan sengaja berhak untuk "memotong" permintaan yang paling berbahaya. Kita hanya bisa berharap bahwa pengembangan mekanisme akses terpercaya akan memungkinkan kekuatan AI untuk digunakan dalam penelitian biologis yang serius juga, tanpa membuat ancaman baru.

Pertanyaan yang sering ditanyakan

Fable 5 Renewal perlindungan biologis dan pengurangan switching Opus 5