Anthropic Meluncurkan Claude Opus 5: Performa Elit dengan Biaya Setengahnya

Anthropic telah resmi meluncurkan Claude Opus 5, model flagship baru yang dirancang untuk mendisrupsi pasar LLM kelas atas dengan menawarkan performa yang hampir setara dengan Claude Fable 5 premium pada titik harga yang jauh lebih rendah. Langkah strategis ini bertujuan untuk menetralkan tekanan harga dari kompetitor seperti GPT-5.6 Sol, sekaligus menyediakan alat yang lebih efisien bagi pengembang untuk pengodean dan pekerjaan pengetahuan yang kompleks.

Mendisrupsi Batas Harga-Performa

Fitur yang paling mencolok dari Claude Opus 5 adalah struktur harganya yang agresif. Jika Claude Fable 5 tingkat atas berbiaya $10 per satu juta token input dan $50 per satu juta token output, Opus 5 memangkas tarif tersebut menjadi setengahnya, dengan harga $5 per satu juta token input dan $25 per satu juta token output.

Untuk menangani kebutuhan latensi, Anthropic juga memperkenalkan "Fast Mode," yang meningkatkan kecepatan pemrosesan sebesar 2,5x, meskipun harus dibayar dengan harga token yang dua kali lipat. Penetapan harga bertingkat ini, dikombinasikan dengan jendela konteks masif sebesar 1 juta token, memposisikan Opus 5 sebagai model default baru untuk Claude Max dan opsi paling mumpuni bagi pengguna Claude Pro.

Supremasi Benchmark dalam Pengodean dan Penalaran

Opus 5 bukan sekadar alternatif hemat biaya; ia adalah mesin performa yang tangguh di domain tertentu. Dalam pengodean terminal agentic melalui Frontier-Bench v0.1, Opus 5 mencapai skor 43,3%, secara signifikan mengungguli Fable 5 (33,7%) dan GPT-5.6 Sol (34,4%). Model ini juga menunjukkan dominasi dalam pekerjaan pengetahuan, memimpin benchmark GDPval-AA v2 dengan skor Elo 1.861.

Mungkin statistik yang paling mengejutkan datang dari benchmark ARC-AGI-3, yang mengukur pemecahan masalah baru. Opus 5 mencetak skor 30,2%, hampir empat kali lipat dari skor 7,8% yang dicapai oleh GPT-5.6 Sol. Hal ini menunjukkan lompatan besar dalam kemampuan model untuk menangani tugas-tugas yang berada di luar pola data pelatihannya.

Skalabilitas Upaya Cerdas dan Efisiensi

Anthropic telah memperkenalkan sistem "effort" (upaya) yang canggih, yang memungkinkan pengguna untuk beralih di antara lima pengaturan: low, medium, high, xhigh, dan max. Hal ini memungkinkan adanya pertukaran (trade-off) yang granular antara konsumsi token dan kedalaman penalaran.

Meskipun Anthropic merekomendasikan pengaturan "low" dan "medium" untuk tugas-tugas umum guna mengoptimalkan biaya, mereka menyarankan penggunaan "xhigh" untuk pengodean agentic yang kompleks. Menariknya, perusahaan mencatat adanya penurunan hasil (diminishing return) pada pengaturan "max"; baik pada Frontier-Bench v0.1 maupun Artificial Analysis Coding Agent Index, Opus 5 justru mengalami sedikit penurunan performa pada upaya maksimum meskipun biayanya lebih tinggi, yang menunjukkan bahwa pengaturan "xhigh" mungkin merupakan titik optimal (sweet spot) saat ini untuk efisiensi.

Peningkatan Keamanan dan Otonomi

Sebagai respons langsung terhadap masukan pengguna, Anthropic telah menyempurnakan pengklasifikasi keamanan untuk Opus 5. Filter siber model ini terpicu sekitar 85% lebih jarang dibandingkan pada Fable 5, menjawab kritik sebelumnya mengenai pemblokiran yang terlalu berlebihan terhadap penelitian yang sah. Meskipun masih mencegah pembuatan eksploitasi dan pemindaian berbasis biner, model ini jauh lebih permisif untuk penelitian kerentanan kode sumber.

Selain itu, Opus 5 menunjukkan kemampuan koreksi diri yang ditingkatkan. Dalam pengujian dunia nyata, model ini berhasil membangun model 3D di FreeCAD dengan menulis pipeline computer vision-nya sendiri untuk menginterpretasikan geometri—sebuah tugas yang membingungkan semua model pesaing lainnya.

Poin-Poin Penting

  • Pengurangan Biaya yang Drastis: Opus 5 menawarkan performa tingkat flagship dengan biaya token hanya 50% dari Claude Fable 5.
  • Terobosan Penalaran: Model ini menunjukkan keunggulan masif sebesar 4x lipat dibandingkan kompetitor dalam benchmark ARC-AGI-3 untuk pemecahan masalah baru.
  • Alur Kerja Pengembang yang Dioptimalkan: Dengan pengklasifikasi keamanan yang ditingkatkan dan pengaturan "effort" khusus, Opus 5 memberikan pengalaman yang lebih lancar untuk pengodean agentic dan penelitian.