Anthropic telah melancarkan model Claude Fable 5.1 dan Mythos 5.1 yang amat dinantikan secara rasmi, menyasarkan permintaan yang semakin meningkat untuk ejen AI yang cekap dan berprestasi tinggi. Kemas kini ini memfokuskan pada pengurangan kos operasi, memperhalusi pagar keselamatan, dan meningkatkan keupayaan penaakulan untuk aliran kerja pelbagai langkah yang kompleks.
Pengurangan Kos Drastik untuk Aliran Kerja Agentic
Salah satu peralihan paling ketara dalam pelancaran ini ialah struktur harga baharu yang agresif yang direka untuk tugasan "agentic"—aliran kerja di mana AI mesti melaksanakan pelbagai langkah berulang untuk mencapai matlamat. Anthropic mendakwa bahawa Claude Fable 5.1 biasanya 25% lebih murah daripada pendahulunya, Fable 5, tetapi boleh menawarkan penjimatan sehingga 45% untuk operasi agentic yang kompleks.
Pengurangan besar-besaran ini dicapai melalui pengoptimuman harga pada data tersimpan (cached data). Dengan mengurangkan kos bagi data yang telah diproses dan disimpan, Anthropic menjadikannya berdaya maju dari segi ekonomi bagi pembangun untuk membina ejen AI jangka panjang yang intensif memori yang bergantung pada pengambilan konteks berulang.
Keupayaan Pengkodan dan Penaakulan yang Unggul
Pengguna awal industri sudah mula melaporkan lonjakan prestasi yang ketara. Dan Shipper, CEO Every, telah melabelkan Fable 5.1 sebagai model pengkodan terkuat yang tersedia pada masa ini, dengan menyatakan bahawa model tersebut bukan sahaja lebih pantas dan lebih cekap token, tetapi juga mempunyai nada perbualan yang lebih semula jadi dan menyerupai manusia.
Penambahbaikan ini melangkaui penjanaan teks ringkas kepada interpretasi data yang bernuansa. CEO Box, Aaron Levie, menyatakan bahawa ejen syarikatnya yang menggunakan Fable 5.1 mampu mengesan kehalusan dan kekaburan dalam set data yang terlepas sepenuhnya oleh model Fable 5 sebelum ini. Tambahan pula, model Mythos 5.1 telah menunjukkan kecekapan yang luar biasa; data penanda aras menunjukkan bahawa Mythos 5.1 dalam mod "low reasoning" berprestasi setanding dengan tetapan "Max reasoning" generasi sebelumnya, yang mewakili lonjakan besar dalam kecekapan seni bina.
Pagar Keselamatan yang Diperhalusi dan Privasi Perusahaan
Anthropic juga menangani kritikan lama mengenai penapis keselamatan yang "terlampau bersemangat". Fable 5.1 menampilkan pagar keselamatan yang lebih tepat, menjadikannya kurang cenderung untuk mencetuskan positif palsu pada pertanyaan yang tidak berbahaya, seperti soalan biologi asas. Walaupun Mythos 5.1 mengekalkan sekatan biologi yang lebih ketat, matlamat keseluruhannya adalah pengalaman pengguna yang lebih berfokuskan utiliti.
Dalam kejayaan besar bagi keselamatan perusahaan, Anthropic mengumumkan "Enterprise Frontier Safeguards" miliknya. Bakal dilancarkan pada musim luruh ini, ciri ini membolehkan "privasi lengkap" dengan membolehkan pelanggan menyimpan data pada pelayan awan mereka sendiri dan bukannya pada infrastruktur Anthropic. Selain itu, walaupun Fable 5.1 kini dibenarkan untuk mengenal pasti kerentanan perisian, Anthropic mengekalkan sempadan yang ketat dengan mengalihkan tugasan berisiko tinggi—seperti penjanaan eksploitasi dan ujian penembusan—kepada model Opus yang lebih berkuasa.
Ringkasan Utama
- Kecekapan Ekonomi: Claude Fable 5.1 menawarkan kos sehingga 45% lebih rendah untuk tugasan agentic melalui pengoptimuman harga data tersimpan.
- Peningkatan Prestasi: Maklum balas awal menonjolkan keupayaan pengkodan yang unggul, pengendalian kekaburan data yang lebih baik, dan kecekapan penaakulan yang dipertingkatkan.
- Privasi yang Dipertingkatkan: Enterprise Frontier Safeguards yang baharu akan membolehkan perniagaan menyimpan data pada pelayan awan mereka sendiri untuk memastikan privasi menyeluruh.
