Anthropic એ તેના સિસ્ટમ-પ્રોમ્પ્ટ સૂચનાઓના 80% હટાવી દીધા છે અને Opus 5 લોન્ચ કર્યું છે, જે એક નવું Claude Code મોડેલ છે જે દિવસો અથવા અઠવાડિયા સુધી સ્વાયત્ત રીતે (autonomously) ચાલી શકે છે અને Arc AGI benchmark પર 30% સ્કોર કરે છે. આ “press-delete” રિડિઝાઇન, જેને કંપની “unhobbling” વ્યૂહરચના કહે છે, તે AI ની મૂળ ક્ષમતાઓને સોફ્ટવેરના એવા બંધનો વિના બહાર લાવે છે જે સામાન્ય રીતે લાર્જ લેંગ્વેજ મોડેલ્સને માત્ર ચેટ મોડમાં જ રાખે છે.

આ ફેરફાર શા માટે મહત્વનો છે

Anthropic ના એન્જિનિયરો Claude માં ગાર્ડરેલ્સ (guardrails) નો એક સઘન સેટ ઉમેરતા હતા—એવા સ્પષ્ટ પ્રોમ્પ્ટ્સ જે મોડેલને શું કહેવું, શું ન કહેવું અને કાર્ય પર કેવી રીતે ધ્યાન કેન્દ્રિત રાખવું તે જણાવે છે. તે પ્રોમ્પ્ટ્સ પટ્ટા (leash) જેવું કામ કરે છે, જે મોડેલને અપ્રમાણિત વર્તણૂક તરફ જતું અટકાવે છે પરંતુ તેની સિદ્ધિઓને પણ મર્યાદિત કરે છે. જ્યારે Opus 5 આવ્યું, ત્યારે ટીમે આખો પ્રોમ્પ્ટ સ્ટેક ડિલીટ કરી દીધો, અને પછી એક પછી એક સૂચનાઓ ફરીથી ઉમેરી, દરેકની અસર માપી. નવું મોડેલ વધુ સક્ષમ હોવાથી, તેઓએ મૂળ શબ્દોનો મોટાભાગનો હિસ્સો કાઢી નાખ્યો અને તેમ છતાં વિશ્વસનીય પરિણામો મળ્યા. સિસ્ટમ હવે ઉચ્ચ-સ્તરીય લક્ષ્ય સમજે છે અને સંપૂર્ણ ફાઇલો અને ફીચર્સ જનરેટ કરે છે.

ટેકનિકલ ફાયદો

  • Benchmark leap – Opus 5 એ Arc AGI benchmark પર 30% સ્કોર મેળવ્યો છે, જે એક એવું માપદંડ છે જે નવા પ્રશ્નો ઉકેલવાની મોડેલની ક્ષમતાને માપે છે. અગાઉના Claude વર્ઝન આ સ્કોરથી ઘણું નીચે હતા, જે કાચી તર્કશક્તિ (raw reasoning power) માં નોંધપાત્ર વધારો સૂચવે છે.
  • Extended autonomy – “Auto Mode” ફીચર મોડેલને લાંબા સમય સુધી કાર્ય કરવા દે છે, જે પોતાનું કોન્ટેક્સ્ટ જાળવી રાખે છે અને સતત માનવીય હસ્તક્ષેપ વગર પ્રગતિ કરે છે. વ્યવહારમાં, એક ડેવલપર મોડેલને સ્પષ્ટીકરણ (specification) આપી શકે છે અને તેને દિવસો સુધી કામ કરવા માટે છોડી શકે છે, અને જ્યારે કોઈ મહત્વપૂર્ણ તબક્કો (milestone) પ્રાપ્ત થાય ત્યારે જ તપાસ કરી શકે છે.
  • Hardening against prompt injection – પ્રોમ્પ્ટ ઇન્જેક્શન યુઝર ઇનપુટમાં દૂષિત સૂચનાઓ દાખલ કરીને મોડેલને તેના સુરક્ષા નિયમો અવગણવા માટે છેતરે છે. Anthropic કહે છે કે Opus 5 તેના પૂર્વવર્તીઓ કરતા આ હુમલાનો વધુ સારી રીતે સામનો કરે છે, જે આંતરિક સંશોધન અને શંકાસ્પદ પેટર્નને ઓળખતા વિશિષ્ટ ક્લાસિફાયર્સને આભારી છે. તેઓ લોન્ચ કરતા પહેલા એક્ઝિટ ક્રાઇટેરિયા (exit criteria) અને ગાર્ડરેલ્સ વ્યાખ્યાયિત કરવાની પણ ભલામણ કરે છે.

ડેવલપર્સ અને એન્ટરપ્રાઇઝ માટેના જોખમો અને તકો

AI-સંચાલિત સાધનો બનાવતા સ્ટાર્ટઅપ્સ માટે, આ ફેરફાર “product overhang”—એટલે કે મોડેલ શું કરી શકે છે અને તેની આસપાસનું સોફ્ટવેર તેને શું કરવા દે છે તે વચ્ચેનો તફાવત—તેને વધારે છે. આ અવરોધને દૂર કરીને, Claude Code એક સાદા ચેટ ઇન્ટરફેસને ફૂલ-સ્ટેક ડેવલપમેન્ટ આસિસ્ટન્ટમાં બદલી શકે છે જે સ્વાયત્ત રીતે કોડ લખે છે, ટેસ્ટ કરે છે અને રિફેક્ટર કરે છે. જે એન્ટરપ્રાઇઝ આ મોડેલ અપનાવશે તેઓ પુનરાવર્તિત કોડિંગ કાર્યોમાં વિતાવાતા સમયને ઘટાડી શકશે, જેનાથી એન્જિનિયરો ઉચ્ચ-સ્તરીય ડિઝાઇન કાર્ય માટે મુક્ત થશે.

“unhobbling” નો સાચો અર્થ શું છે

Cherny એ સક્ષમ મોડેલને કૃત્રિમ મર્યાદાઓમાંથી મુક્ત કરવા માટે “unhobbling” શબ્દ આપ્યો છે. ઘણા AI ઉત્પાદનોમાં, ડેવલપર્સ જાણીજોઈને મોડેલ શું કરી શકે છે તેના પર મર્યાદાઓ મૂકે છે કારણ કે UI અથવા પોલિસી ફ્રેમવર્ક મોડેલના સંપૂર્ણ વ્યાપ માટે તૈયાર હોતું નથી. પરિણામે “product overhang” ઊભું થાય છે જ્યાં AI વણવપરાયેલી ક્ષમતાના પાયા પર બેસી રહે છે. Claude Code તે ક્ષમતાને વાસ્તવિક ઉપયોગમાં લાવે છે, જે મોડેલને માત્ર પ્રશ્ન-જવાબ આપતા બોટને બદલે સોફ્ટવેરના સહ-લેખક (co-author) તરીકે કાર્ય કરવા દે છે.

સ્થાપકો અને વિદ્યાર્થીઓ માટે સલાહ

  • Spot the overhang – એવા કાર્યો શોધો જ્યાં હાલના AI સાધનો તેમની વર્તમાન મર્યાદાઓની બરાબર બહાર અટકી જાય છે. આ એવા સરળ તકો છે જ્યાં “unhobbling” અભિગમ અપેક્ષા કરતા વધુ વળતર આપી શકે છે.
  • Stretch the model – AI ને એવા કામ સોંપો જે તેની જાહેરાત કરેલી ક્ષમતાઓથી થોડા વધારે લાગે. મોડેલનું આંતરિક તર્ક તમને આશ્ચર્યચકિત કરી શકે છે, ખાસ કરીને જ્યારે તમે પ્રોમ્પ્ટ ઘર્ષણ (prompt friction) ઘટાડો છો.
  • Define clear guardrails – મોડેલને અનિયંત્રિત રીતે ચાલવા દેતા પહેલા, એક્ઝિટ કન્ડિશન (દા.ત., મહત્તમ રનટાઇમ, રિસોર્સ કેપ્સ) અને સુરક્ષા તપાસ નક્કી કરો. આ AI ને જોખમો મર્યાદિત રાખીને સંશોધન કરવા દે છે.

વિદ્યાર્થીઓએ સિદ્ધાંતને પ્રેક્ટિસ સાથે જોડવો જોઈએ. અલ્ગોરિધમ્સમાં નિપુણતા મેળવવી મૂલ્યવાન છે, પરંતુ તે જ્ઞાનને પ્રોડક્ટ થિંકિંગ અને ડેટા-આધારિત પ્રયોગો સાથે જોડવાથી AI-પ્રથમ બિલ્ડર્સની આગામી લહેર સક્ષમ બનશે.

આગળ શું જોવું

Takeaway: તેના મોટાભાગના સિસ્ટમ પ્રોમ્પ્ટ્સ ડિલીટ કરીને, Anthropic એ એક સ્માર્ટ મોડેલને ખૂબ જ ઓછા માર્ગદર્શન સાથે કાર્ય કરવા દીધું છે, જેનાથી Claude Code એક સ્વાયત્ત કોડર બની ગયું છે જે અઠવાડિયા લાંબા પ્રોજેક્ટ્સને સંભાળી શકે છે.