Anthropic iliondoa asilimia 80 ya maelekezo yake ya mfumo (system-prompt) na kuzindua Opus 5, modeli mpya ya Claude Code inayoweza kufanya kazi yenyewe kwa siku au wiki kadhaa na kupata alama ya 30% kwenye kipimo cha Arc AGI. Mabadiliko haya ya "press-delete", ambayo kampuni inayaita mkakati wa "unhobbling" (kuondoa vikwazo), huruhusu uwezo halisi wa AI kujitokeza bila minyororo ya programu ambayo kwa kawaida huifanya mifano mikubwa ya lugha (LLMs) iishie kwenye hali ya mazungumzo tu.
Kwa nini mabadiliko haya ni muhimu
Wahandisi wa Anthropic walikuwa wakijaza Claude kwa seti nzito ya vizuizi (guardrails)—maelekezo ya wazi yanayoiambia modeli nini cha kusema, nini kisichosemwa, na jinsi ya kubaki kwenye lengo. Maelekezo hayo hufanya kazi kama kamba ya mnyama, ikizuia modeli isitoke nje ya mipaka ya tabia zilizojaribiwa lakini pia ikizuia uwezo wake wa kufanya mambo makubwa. Opus 5 ilipofika, timu ilifuta mrundikano mzima wa maelekezo, kisha ikarudia kuongeza maelekezo moja baada ya jingine, ikipima athari ya kila moja. Kwa sababu modeli mpya ina uwezo mkubwa zaidi, waliondoa maneno mengi ya awali na bado wakapata matokeo ya kuaminika. Mfumo sasa unaelewa lengo kuu na kuzalisha faili na vipengele kamili.
Faida za kiufundi
- Hatua kubwa katika vipimo – Opus 5 ilifikia alama ya 30% kwenye kipimo cha Arc AGI, kipimo kinachopima uwezo wa modeli kutatua matatizo mapya. Matoleo ya awali ya Claude yalipata alama ya chini sana, ikionyesha ongezeko kubwa la uwezo wa kufikiri (reasoning power).
- Uhuru wa muda mrefu – Kipengele cha "Auto Mode" kinaruhusu modeli kufanya kazi kwa muda mrefu, ikidumisha muktadha wake wenyewe na kupiga hatua bila kusukumwa mara kwa mara na binadamu. Kiuhalisia, mwanatengeneza programu (developer) anaweza kumpa modeli maelezo ya kazi na kuiacha ifanye kazi kwa siku kadhaa, akirudi tu wakati hatua fulani muhimu imefikiwa.
- Uimara dhidi ya prompt injection – "Prompt injection" huivuta modeli kupuuza sheria zake za usalama kwa kuingiza maelekezo yenye nia mbaya kwenye maingizo ya mtumiaji. Anthropic inasema Opus 5 inapinga shambulio hili vizuri zaidi kuliko matoleo yake ya awali, kutokana na utafiti wa ndani na mifumo maalum ya utambuzi (classifiers) inayobainisha mifumo inayotia shaka. Pia wanashauri kuweka vigezo vya kumaliza kazi na vizuizi kabla ya kuanza.
Changamoto na fursa kwa watengenezaji na makampuni
Kwa kampuni changa (startups) zinazotengeneza zana zinazotumia AI, mabadiliko haya yanapanua "product overhang"—pengo kati ya kile modeli inachoweza kufanya na kile programu zinazozunguka zinachoruhusu ifanye. Kwa kuondoa pengo hilo, Claude Code inaweza kugeuza kiolesura rahisi cha mazungumzo kuwa msaidizi kamili wa uundaji programu (full-stack development assistant) ambaye huandika, hujaribu, na kurekebisha (refactor) kodi yenyewe. Makampuni yanayotumia modeli hii yanaweza kupunguza muda unaotumika kwenye kazi za kodi zinazojirudia, na kuwapa wahandisi nafasi ya kufanya kazi za usanifu wa hali ya juu.
Maana halisi ya “unhobbling”
Cherny alibuni neno "unhobbling" kuelezea kuikomboa modeli yenye uwezo kutoka kwa vizuizi vya bandia. Katika bidhaa nyingi za AI, watengenezaji huweka mipaka kwa makusudi kwenye kile modeli inachoweza kujaribu kwa sababu kiolesura (UI) au mfumo wa sera haujajiandaa kwa uwezo kamili wa modeli. Matokeo yake ni "product overhang" ambapo AI inakaa kwenye kilele cha uwezo ambao hautumiki. Claude Code inaleta uwezo huo ardhini, ikiruhusu modeli kufanya kazi kama mwandishi mwenza wa programu badala ya kuwa roboti ya kujibu maswali tu.
Ushauri kwa waanzilishi na wanafunzi
- Tambua pengo la uwezo (overhang) – Angalia kazi ambazo zana za AI zilizopo zinashindwa kufanya zinapofika mwisho wa mipaka yao ya sasa. Hizo ni fursa rahisi ambapo mbinu ya "unhobbling" inaweza kuleta matokeo makubwa.
- Panua uwezo wa modeli – Mpe AI kazi ambazo zinaonekana kuwa kidogo zaidi ya uwezo wake uliotangazwa. Uwezo wa modeli wa kufikiri wa ndani unaweza kukushangaza, hasa unapopunguza vikwazo vya maelekezo (prompt friction).
- Weka vizuizi vya wazi – Kabla ya kuruhusu modeli ifanye kazi bila usimamizi, weka masharti ya kumaliza kazi (kama vile muda wa juu wa kufanya kazi, mipaka ya rasilimali) na ukaguzi wa usalama. Hii inaruhusu AI kuchunguza huku ikizuia hatari.
Wanafunzi wanapaswa kuchanganya nadharia na vitendo. Kujifunza kanuni (algorithms) ni muhimu, lakini kuunganisha maarifa hayo na ufikiri wa bidhaa na majaribio yanayozingatia data kutawawezesha wajenzi wa kizazi kijacho wanaotumia AI kwanza.
Nini cha kufuatilia baadaye
Muhtasari: Kwa kufuta sehemu kubwa ya maelekezo yake ya mfumo, Anthropic iliruhusu modeli yenye akili zaidi kufanya kazi kwa msaada mdogo sana, na kuigeuza Claude Code kuwa msimboji (coder) anayejitegemea ambaye anaweza kushughulikia miradi inayochukua wiki kadhaa.
