Anthropic தனது Claude Opus 5-ஐ அறிமுகப்படுத்துகிறது: பாதி விலையில் சிறந்த செயல்திறன்
Anthropic தனது புதிய முதன்மை மாடலான Claude Opus 5-ஐ அதிகாரப்பூர்வமாக அறிமுகப்படுத்தியுள்ளது. இது பிரீமியம் Claude Fable 5 மாடலுக்கு இணையான திறனை, மிகக் குறைந்த விலையில் வழங்குவதன் மூலம் உயர்தர LLM சந்தையில் மாற்றத்தை ஏற்படுத்த வடிவமைக்கப்பட்டுள்ளது. இந்த மூலோபாய நடவடிக்கை, GPT-5.6 Sol போன்ற போட்டியாளர்களிடமிருந்து வரும் விலைப் போட்டியைச் சமாளிப்பதோடு, டெவலப்பர்களுக்கு கோடிங் (coding) மற்றும் சிக்கலான அறிவுசார் பணிகளுக்கான (knowledge work) மிகவும் திறமையான கருவியையும் வழங்குகிறது.
விலை-செயல்திறன் எல்லையை மாற்றியமைத்தல்
Claude Opus 5-ன் மிகவும் வியக்கத்தக்க அம்சம் அதன் ஆக்ரோஷமான விலை நிர்ணயக் கட்டமைப்பாகும். உயர்தர Claude Fable 5 மாடல் ஒரு மில்லியன் இன்புட் டோக்கன்களுக்கு (input tokens) $10 மற்றும் ஒரு மில்லியன் அவுட்புட் டோக்கன்களுக்கு (output tokens) $50 செலவாகும் நிலையில், Opus 5 இந்த விலையை பாதியாகக் குறைத்துள்ளது; அதாவது ஒரு மில்லியன் இன்புட் டோக்கன்களுக்கு $5 மற்றும் ஒரு மில்லியன் அவுட்புட் டோக்கன்களுக்கு $25 என நிர்ணயிக்கப்பட்டுள்ளது.
தாமதத்தைக் (latency) குறைக்க, Anthropic ஒரு "Fast Mode"-ஐ அறிமுகப்படுத்தியுள்ளது. இது செயலாக்க வேகத்தை (processing speed) 2.5 மடங்கு அதிகரிக்கிறது, ஆனால் இதற்கு டோக்கன் விலை இருமடங்காக உயரும். இந்த அடுக்கு விலை நிர்ணயம் (tiered pricing) மற்றும் 1 மில்லியன் டோக்கன்கள் கொண்ட பிரம்மாண்டமான கான்டெக்ஸ்ட் விண்டோ (context window) ஆகியவை, Opus 5-ஐ Claude Max-க்கான புதிய இயல்புநிலை (default) மாடலாகவும், Claude Pro பயனர்களுக்கான மிகவும் திறன்மிக்க விருப்பமாகவும் மாற்றுகின்றன.
கோடிங் மற்றும் தர்க்கரீதியான சிந்தனையில் (Reasoning) முன்னிலை
Opus 5 என்பது வெறும் மலிவான மாற்றீடு மட்டுமல்ல; இது குறிப்பிட்ட துறைகளில் ஒரு செயல்திறன் மிக்க சக்தியாகும். Frontier-Bench v0.1 மூலம் மேற்கொள்ளப்பட்ட ஏஜென்டிக் டெர்மினல் கோடிங்கில் (agentic terminal coding), Opus 5 43.3% மதிப்பெண்ணைப் பெற்று, Fable 5 (33.7%) மற்றும் GPT-5.6 Sol (34.4%) ஆகிய இரண்டையும் விடச் சிறந்து விளங்குகிறது. மேலும், அறிவுசார் பணிகளிலும் (knowledge work) இது ஆதிக்கம் செலுத்துவதைக் காட்டியுள்ளது; GDPval-AA v2 பெஞ்ச்மார்க்கில் 1,861 Elo மதிப்பெண்ணுடன் முன்னணியில் உள்ளது.
புதிய சிக்கல்களைத் தீர்க்கும் திறனை (novel problem-solving) அளவிடும் ARC-AGI-3 பெஞ்ச்மார்க்கில் இருந்து வரும் புள்ளிவிவரமே மிகவும் வியப்பிற்குரியது. Opus 5 30.2% மதிப்பெண் பெற்றுள்ளது, இது GPT-5.6 Sol பெற்ற 7.8% மதிப்பெண்ணை விட கிட்டத்தட்ட நான்கு மடங்கு அதிகம். இது, தனது பயிற்சித் தரவு முறைகளுக்கு (training data patterns) அப்பாற்பட்ட பணிகளைக் கையாளுவதில் இந்த மாடல் அடைந்துள்ள மிகப்பெரிய முன்னேற்றத்தைக் காட்டுகிறது.
புத்திசாலித்தனமான முயற்சி அளவீடு மற்றும் செயல்திறன்
Anthropic ஒரு நுணுக்கமான "effort" அமைப்பை அறிமுகப்படுத்தியுள்ளது. இதன் மூலம் பயனர்கள் low, medium, high, xhigh மற்றும் max என ஐந்து அமைப்புகளுக்கு இடையே மாற்றிக்கொள்ள முடியும். இது டோக்கன் பயன்பாட்டிற்கும் (token consumption) தர்க்கரீதியான ஆழத்திற்கும் (reasoning depth) இடையே துல்லியமான சமநிலையை (trade-off) பேண அனுமதிக்கிறது.
செலவுகளைக் குறைக்க பொதுவான பணிகளுக்கு "low" மற்றும் "medium" அமைப்புகளைப் பயன்படுத்த Anthropic பரிந்துரைக்கிறது; ஆனால் சிக்கலான ஏஜென்டிக் கோடிங்கிற்கு (agentic coding) "xhigh" அமைப்பைப் பயன்படுத்த அறிவுறுத்துகிறது. சுவாரஸ்யமாக, "max" அமைப்பில் செயல்திறன் குறைவதைக் நிறுவனம் கவனித்துள்ளது; Frontier-Bench v0.1 மற்றும் Artificial Analysis Coding Agent Index ஆகிய இரண்டிலும், அதிக செலவு செய்தும் Opus 5-ன் செயல்திறன் அதிகபட்ச முயற்சியில் (maximum effort) சற்று குறைந்ததைக் காண முடிந்தது. இது, செயல்திறனுக்கு "xhigh" அமைப்பே தற்போது சிறந்த தேர்வாக (sweet spot) இருக்கலாம் என்பதைக் காட்டுகிறது.
மேம்படுத்தப்பட்ட பாதுகாப்பு மற்றும் தன்னாட்சி (Autonomy)
பயனர்களின் கருத்துகளுக்கு நேரடிப் பதிலளிக்கும் விதமாக, Anthropic Opus 5-க்கான பாதுகாப்பு வகைப்படுத்தல்களை (safety classifiers) மேம்படுத்தியுள்ளது. இதன் சைபர் ஃபில்டர்கள் (cyber filters), Fable 5-ஐ விட சுமார் 85% குறைவாகவே செயல்படுகின்றன. இது, முறையான ஆராய்ச்சிகளைத் தேவையில்லாமல் தடுப்பது குறித்த முந்தைய விமர்சனங்களுக்குத் தீர்வாக அமைகிறது. இது இன்னும் எக்ஸ்ப்ளோயிட் உருவாக்கம் (exploit generation) மற்றும் பைனரி அடிப்படையிலான ஸ்கேனிங் (binary-based scanning) ஆகியவற்றைத் தடுத்தாலும், சோர்ஸ் கோட் பாதிப்பு ஆராய்ச்சிக்கு (source code vulnerability research) மிகவும் நெகிழ்வானதாக உள்ளது.
மேலும், Opus 5 மேம்படுத்தப்பட்ட சுய-திருத்தத் திறன்களைக் (self-correction capabilities) கொண்டுள்ளது. நிஜ உலகச் சோதனையில், வடிவியலை (geometry) புரிந்துகொள்ளத் தனது சொந்த கம்ப்யூட்டர் விஷன் பைப்லைனை (computer vision pipeline) எழுதுவதன் மூலம், FreeCAD-இல் ஒரு 3D மாடலை வெற்றிகரமாக உருவாக்கியது—மற்ற அனைத்துப் போட்டியாள மாடல்களும் தோல்வியடைந்த ஒரு பணியை இது செய்து காட்டியது.
முக்கியக் குறிப்புகள்
- அதிவேகக் கட்டணக் குறைப்பு: Claude Fable 5-ன் டோக்கன் விலையில் 50% விலையிலேயே Opus 5 முதன்மைத் தர செயல்திறனை வழங்குகிறது.
- தர்க்கரீதியான முன்னேற்றம்: புதிய சிக்கல்களைத் தீர்க்கும் ARC-AGI-3 பெஞ்ச்மார்க்கில், போட்டியாளர்களை விட இந்த மாடல் 4 மடங்கு அதிக முன்னிலையைக் காட்டியது.
- மேம்படுத்தப்பட்ட டெவலப்பர் பணிப்பாய்வு: மேம்படுத்தப்பட்ட பாதுகாப்பு வகைப்படுத்தல்கள் மற்றும் பிரத்யேக "effort" அமைப்புகளுடன், Opus 5 ஏஜென்டிக் கோடிங் மற்றும் ஆராய்ச்சிக்கு மிகவும் தடையற்ற அனுபவத்தை வழங்குகிறது.
