Anthropic memangkas 80% instruksi prompt sistemnya dan meluncurkan Opus 5, model Claude Code baru yang dapat berjalan secara otonom selama berhari-hari atau berminggu-minggu dan meraih skor 30% pada benchmark Arc AGI. Desain ulang "press-delete" ini, yang disebut perusahaan sebagai strategi "unhobbling", memungkinkan kemampuan murni AI muncul tanpa belenggu perangkat lunak yang biasanya menjaga model bahasa besar tetap dalam mode khusus obrolan saja.
Mengapa perubahan ini penting
Para insinyur Anthropic biasanya mengisi Claude dengan serangkaian guardrails yang padat—prompt eksplisit yang memberi tahu model apa yang harus dikatakan, apa yang tidak boleh dikatakan, dan bagaimana agar tetap pada tugasnya. Prompt tersebut bertindak seperti tali kekang, mencegah model menyimpang ke perilaku yang belum teruji tetapi juga membatasi apa yang dapat dicapainya. Ketika Opus 5 tiba, tim menghapus seluruh tumpukan prompt, lalu menambahkan kembali instruksi satu per satu, sambil mengukur dampak dari masing-masing instruksi tersebut. Karena model baru ini lebih mumpuni, mereka menghapus sebagian besar kata-kata aslinya dan tetap mendapatkan hasil yang andal. Sistem sekarang memahami tujuan tingkat tinggi dan menghasilkan file serta fitur yang lengkap.
Keuntungan teknis
- Lonjakan benchmark – Opus 5 mencapai skor 30% pada benchmark Arc AGI, sebuah metrik yang mengukur kemampuan model untuk memecahkan masalah baru. Versi Claude sebelumnya meraih skor jauh di bawah angka tersebut, yang menunjukkan lonjakan substansial dalam kekuatan penalaran murni.
- Otonomi yang diperluas – Fitur "Auto Mode" memungkinkan model beroperasi untuk jangka waktu yang lama, mempertahankan konteksnya sendiri dan membuat kemajuan tanpa dorongan manusia yang terus-menerus. Dalam praktiknya, seorang pengembang dapat menyerahkan spesifikasi kepada model dan membiarkannya melakukan iterasi selama berhari-hari, dan hanya memeriksa kembali saat sebuah tonggak pencapaian (milestone) tercapai.
- Penguatan terhadap prompt injection – Prompt injection menipu model agar mengabaikan aturan keamanannya dengan menyisipkan instruksi berbahaya dalam input pengguna. Anthropic menyatakan bahwa Opus 5 lebih tahan terhadap serangan ini dibandingkan pendahulunya, berkat penelitian internal dan pengklasifikasi khusus yang menandai pola mencurigakan. Mereka juga menyarankan untuk menetapkan kriteria keluar dan guardrails sebelum peluncuran.
Taruhan bagi pengembang dan perusahaan
Bagi startup yang membangun alat berbasis AI, perubahan ini memperlebar "product overhang"—celah antara apa yang dapat dilakukan model dan apa yang diizinkan oleh perangkat lunak di sekitarnya. Dengan mengangkat overhang tersebut, Claude Code dapat mengubah antarmuka obrolan sederhana menjadi asisten pengembangan full-stack yang menulis, menguji, dan melakukan refaktor kode secara otonom. Perusahaan yang mengadopsi model ini dapat memangkas waktu yang dihabiskan untuk tugas pengodean yang berulang, sehingga membebaskan para insinyur untuk pekerjaan desain tingkat tinggi.
Apa arti sebenarnya dari “unhobbling”
Cherny mencetuskan istilah “unhobbling” untuk menggambarkan upaya membebaskan model yang mumpuni dari batasan buatan. Dalam banyak produk AI, pengembang sengaja membatasi apa yang dapat dicoba oleh model karena UI atau kerangka kebijakan belum siap untuk cakupan penuh model tersebut. Hasilnya adalah “product overhang” di mana AI berada di atas alas potensi yang tidak terpakai. Claude Code membawa potensi tersebut ke tingkat praktis, membiarkan model bertindak sebagai rekan penulis perangkat lunak, bukan sekadar bot penjawab pertanyaan.
Saran bagi pendiri dan mahasiswa
- Temukan overhang – Cari tugas-tugas di mana alat AI yang ada tersandung tepat di luar batas kemampuannya saat ini. Itu adalah peluang yang mudah diraih di mana pendekatan “unhobbling” dapat memberikan hasil yang sangat besar.
- Uji batas model – Berikan tugas kepada AI yang terasa sedikit melampaui kemampuan yang diiklankan. Penalaran internal model mungkin akan mengejutkan Anda, terutama saat Anda mengurangi gesekan prompt.
- Tetapkan guardrails yang jelas – Sebelum membiarkan model berjalan tanpa pengawasan, tetapkan kondisi keluar (misalnya, waktu jalan maksimum, batas sumber daya) dan pemeriksaan keamanan. Ini memungkinkan AI untuk bereksplorasi sambil tetap menjaga risiko tetap terkendali.
Mahasiswa harus memadukan teori dengan praktik. Menguasai algoritma memang berharga, tetapi memasangkan pengetahuan tersebut dengan pemikiran produk dan eksperimentasi berbasis data akan memungkinkan gelombang berikutnya dari pembangun berbasis AI (AI-first builders).
Apa yang perlu diperhatikan selanjutnya
Intisari: Dengan menghapus sebagian besar prompt sistemnya, Anthropic membiarkan model yang lebih cerdas bertindak dengan jauh lebih sedikit bimbingan intensif, mengubah Claude Code menjadi pengode otonom yang dapat menangani proyek selama berminggu-minggu.
