Anthropic-ன் சமீபத்திய மாடலான Fable 5.1, கேச் ரீட் (cache reads) விலையை 75% குறைக்கிறது, இது முந்தைய தலைமுறையுடன் ஒப்பிடும்போது நீண்ட நேரம் இயங்கும் AI ஏஜென்ட்களுக்கான (AI agents) ஒட்டுமொத்த செலவை 45% வரை குறைக்கிறது. இந்த நடவடிக்கை, மனித மேற்பார்வை இன்றி தன்னாட்சி ஏஜென்ட்கள் (autonomous agents) பல மணிநேரம் அல்லது பல நாட்களுக்கு இயங்குவதை நிதி ரீதியாக சாத்தியமாக்குகிறது, இது டெவலப்பர்கள் தயாரிப்பு பணிப்பாய்வுகளில் (production workflows) AI-ஐ எவ்வாறு இணைக்கிறார்கள் என்பதை மாற்றியமைக்கக்கூடும்.

விலைய மாற்றத்தின் முக்கியத்துவம்

வழக்கமான வினவல் பாணி (query-style) பணிகளுக்கு, Fable 5.1 அதன் முந்தைய மாடலை விட ஏற்கனவே 25% மலிவாகத் தெரிகிறது. இருப்பினும், உண்மையான முக்கியத்துவம் வாய்ந்த விஷயம் "ஏஜென்டிக்" (agentic) பணிச்சுமைகளுக்கான (workloads) ஆழமான தள்ளுபடி ஆகும்—அதாவது ஒரு மாடல் சூழலை (context) பராமரித்து, முடிவுகளை எடுத்து, காலப்போக்கில் மீண்டும் மீண்டும் செயல்படும் பணிகள். மாடலின் கேச்சிலிருந்து (cache) படிப்பதற்கான செலவைக் குறைப்பதன் மூலம், ஒவ்வொரு முறையும் முழு கணக்கீட்டு விலையையும் (compute price) செலுத்தாமல், சேமிக்கப்பட்ட தகவல்களை மீண்டும் பயன்படுத்த Anthropic ஏஜென்ட்களுக்கு வழிவகை செய்கிறது. இதன் விளைவாக, முந்தைய படிகளை நினைவில் வைத்து அதன் அடிப்படையில் செயல்பட வேண்டிய ஏஜென்ட்களுக்கான ஒரு மணிநேரக் கட்டணம் பெருமளவு குறைகிறது.

சாட் பாட்களிலிருந்து (chat bots) நீடித்துச் செயல்படும் கருவிகள் வரை

ஏஜென்ட்கள் சாதாரண கேள்வி-பதில் அமைப்புகளிலிருந்து வேறுபட்டவை. அவற்றால்:

  • 38 மணிநேரம் தொடர்ந்து ஒரு இயந்திரக் கற்றல் (machine-learning) சோதனையை நடத்த முடியும் (ஒரு தரவு அறிவியல் குழு demonstrated செய்தது போல).
  • மூன்று நாட்கள் நீடிக்கும் ஒரு முன்மாதிரியை (prototype) உருவாக்க முடியும் (ஒரு தரவுத்தளத் தளம் தெரிவித்தது போல).
  • கருதுகோள்களை (hypotheses) மீண்டும் மீண்டும் சோதிப்பதன் மூலம் ஐந்து ஆண்டுகள் பழமையான மென்பொருள் பிழையை (software defect) சரிசெய்ய முடியும்.

ஒவ்வொரு சூழலும் மாடல் வளர்ந்து வரும் சூழலை (context) தக்கவைக்கவும், முந்தைய முடிவுகளை மறுபரிசீலனை செய்யவும் மற்றும் அதன் அணுகுமுறையை மாற்றியமைக்கவும் கட்டாயப்படுத்துகிறது. புதிய கேச்-ரீட் (cache-read) விலை நிர்ணயம், இத்தகைய நீடித்த செயல்பாட்டை ஒரு சிறிய பரிசோதனையிலிருந்து அன்றாட மேம்பாட்டுப் பணிப்பாய்வுகளுக்கான (development pipelines) செலவு குறைந்த விருப்பமாக மாற்றுகிறது.

புதிய இடர் சூழல்

அதிக தன்னாட்சி (autonomy) ஒரு சவாலைத் தருகிறது. ஒரு ஏஜென்ட் பத்து மணிநேரம் இயங்கும்போது, ஆரம்பத்தில் செய்யப்படும் ஒரு தவறு தொடர்ச்சியான பாதிப்புகளை (cascade) ஏற்படுத்தி, தவறான அடிப்படையில் நேரம் மற்றும் வளங்களை வீணடிக்கலாம். இதன் முக்கிய சவால் "மாடல் போதுமான அளவு புத்திசாலித்தனமாக இருக்கிறதா?" என்பதிலிருந்து "கண்காணிப்பு இன்றி பொறுப்புடன் செயல்பட மாடலை என்னால் நம்ப முடியுமா?" என்பதற்கு மாறுகிறது.

டெவலப்பர்கள் இப்போது கேட்க வேண்டியவை:

  • ஏஜென்ட் தனது சொந்தப் படிகளை எவ்வாறு சரிபார்க்கும்?
  • தவறான அனுமானங்களை அது மீண்டும் மீண்டும் செய்யாமல் தடுக்க என்ன பாதுகாப்பு வழிமுறைகள் உள்ளன?
  • ஏஜென்ட் கவனிக்கப்படாத நேரத்தில் என்ன செய்தது என்பதை எந்தப் பதிவுகள் (logs) அல்லது தணிக்கை தடங்கள் (audit trails) வெளிப்படுத்தும்?

இதற்கான பதில் முற்றிலும் தொழில்நுட்ப ரீதியானது மட்டுமல்ல; இது ஏற்றுக்கொள்ளக்கூடிய தானியங்கி முடிவெடுத்தல் நிலைகள் குறித்த கொள்கை முடிவுகளையும் உள்ளடக்கியது.

டெவலப்பர்கள் அடையக்கூடிய நன்மைகள்

  • குறைந்த இயக்க வரவுசெலவுத் திட்டங்கள் (Lower operating budgets): செலவு காரணமாக தன்னாட்சி ஏஜென்ட்களைப் பயன்படுத்தத் தயங்கிய திட்டங்கள் இப்போது சுதந்திரமாகச் சோதனைகளை மேற்கொள்ளலாம்.
  • நீண்ட காலத் தர்க்கத் திறன் (Longer reasoning horizons): ஏஜென்ட்கள் பெரிய தீர்வுகளை ஆராய முடியும், இது புதிய தீர்வுகள் அல்லது மேம்பாடுகளைக் கண்டறியும் வாய்ப்புகளை அதிகரிக்கிறது.
  • குறைந்த மறுமுறை தாமதம் (Reduced iteration latency): கேச் செய்யப்பட்ட சூழலை (cached context) மீண்டும் பயன்படுத்துவதன் மூலம், மாடல் ஒரே தரவை மீண்டும் செயலாக்குவதைத் தவிர்க்கிறது, இது மீண்டும் மீண்டும் செய்யப்படும் சுழற்சிகளை வேகப்படுத்துகிறது.

முரண்பட்ட கருத்துக்கள் மற்றும் நீடிக்கும் கவலைகள்

விலை குறைப்பு அனைத்துத் தடைகளையும் நீக்கிவிடாது. நீண்ட காலத்திற்கு ஏஜென்ட்களை இயக்குவதன் எளிமை, போதிய சரிபார்ப்பு இன்றி முக்கியமான முடிவெடுக்கும் பணிகளை டெவலப்பர்கள் ஏஜென்ட்களிடம் ஒப்படைக்கத் தூண்டலாம், இது கண்டறியப்படாத பிழைகளின் அபாயத்தை அதிகரிக்கும்.

தற்போதுள்ள கண்காணிப்பு கருவிகள் (monitoring tools) இந்த ஏஜென்ட்களின் தொடர்ச்சியான, நிலைத்தன்மை கொண்ட (stateful) தன்மைக்காக உருவாக்கப்பட்டவை அல்ல என்பதையும் சில குழுக்கள் கண்டறியலாம். முறையான கண்காணிப்பு (observability) இல்லையென்றால், சேமிக்கப்படும் செலவு, பின்னர் பிழைத்திருத்தச் செலவுகளால் (debugging overhead) ஈடுசெய்யப்படலாம்.

அடுத்து கவனிக்க வேண்டியவை

  • வெளிப்படையான ஏஜென்ட் பதிவுகளுக்கான கருவிகள் (Tooling for transparent agent logs): படி-படியாகத் தர்க்கங்களை (step-by-step reasoning) பதிவு செய்யும் தளங்களின் வருகையை எதிர்பார்க்கலாம், இது நீண்ட நேரம் இயங்கும் அமர்வுகளைத் (sessions) தணிக்கை செய்வதை எளிதாக்கும்.

சுருக்கமாகச் சொன்னால்: Anthropic-ன் Fable 5.1, ஏஜென்ட்களை அவ்வப்போது உதவும் உதவியாளர்களிலிருந்து, மலிவான மற்றும் நிலையான கூட்டாளர்களாக மாற்றுகிறது. அடுத்த சவால் விலையல்ல, மாறாக அவை கவனிக்கப்படாத நிலையில் வேலை செய்யும்போது, அந்த கூட்டாளர்களைத் துல்லியமாக வைத்திருக்கும் திறனாகும்.