Anthropic Rilis Claude Fable 5, Model "Mythos-class" Pertama
Anthropic baru saja merilis Claude Fable 5, model "Mythos-class" pertama yang diklaim memiliki kemampuan lebih baik daripada model Opus sebelumnya. Namun, peluncuran model ini dilengkapi dengan fitur keamanan untuk mencegahnya menjawab pertanyaan tentang topik-topik seperti keamanan siber, biologi, dan kimia, yang dapat memiliki dampak buruk jika digunakan oleh aktor jahat.
Fitur Keamanan Fable 5
Menurut Anthropic, Fable 5 beroperasi pada model yang sama dengan Mythos 5, yang akan dirilis secara terbatas untuk sekelompok kecil "cyberdefender" yang dipercaya melalui Proyek Glasswing. Namun, Fable 5 yang dapat diakses oleh publik dirancang untuk mengalihkan pertanyaan tentang topik-topik sensitif ke model Claude Opus 4.8 yang lebih lama dan memberikan peringatan kepada pengguna saat ini terjadi.
Peningkatan Benchmark
Di antara banyak peningkatan benchmark yang diklaim untuk Fable 5, ada peningkatan besar dalam hal keamanan siber.
Keamanan yang Lebih Ketat
Anthropic mengatakan bahwa fitur keamanan ini telah disetel untuk menjadi "lebih ketat dari ideal", yang berarti sistem mungkin kadang-kadang menolak permintaan yang tidak berbahaya. Namun, Anthropic mengklaim bahwa kesalahan seperti ini hanya terjadi pada kurang dari 5% dari semua sesi pengujian, dan dianggap worth it untuk menghindari situasi di mana Mythos dapat memberikan bantuan kepada aktor jahat dalam menyebabkan kerugian serius.