Anthropic longgarkan filter biologi Fable 5 demi tekan blokir keliru
Filter keamanan yang memblokir pertanyaan biologi berbahaya punya masalah klasik: ia juga ikut memblokir pertanyaan yang tidak berbahaya. Seorang pasien yang bertanya soal hasil lab atau gejala bisa memicu aturan yang sebenarnya dibuat untuk mencegah perancangan senjata biologis. Anthropic menyatakan telah menulis ulang aturan classifier di balik Fable 5 agar batas itu lebih cermat, melatih ulang sistem dengan data baru, dan meminta masukan dari pakar internal maupun eksternal sebelum merilis perubahan ini pada 7 Agustus.
Dampaknya besar dan diukur per produk. Fallback terkait biologi, yaitu kasus saat model menolak atau berputar-putar, turun sekitar 85% secara keseluruhan. Penurunannya 67% di Claude.ai, 55% di Cowork, 17% di Claude Code, dan 7% di Claude Platform, yang menunjukkan blokir berlebihan paling parah di produk chat konsumen dan jauh lebih kecil bagi pengembang. Pertanyaan sehari-hari seperti membaca hasil tes darah atau memahami gejala kini semestinya lebih sering diproses. Penjagaan yang lebih berat tetap ada: Fable 5 masih menolak permintaan dual-use yang nyata di bidang virologi, toksikologi, dan desain molekuler, dan mengarahkan pekerjaan biologi mutakhir lewat jalur akses tepercaya alih-alih menjawab terbuka.
Ini lebih soal penyetelan ketimbang pembalikan kebijakan, dan pembacaan jujurnya adalah filter sebelumnya terlalu condong menolak.
Kenapa ini penting
Bagi klinisi, mahasiswa, atau peneliti yang terus terbentur penolakan pada pertanyaan biologi dan kesehatan biasa, perubahan ini langsung menyasar hambatan itu. Ini juga memperlihatkan bagaimana lab menyetel ulang filter keamanan setelah blokir berlebihan, hal yang layak dipantau jika Anda membangun di atas model ini dan perlu memperkirakan kapan model akan menolak.