OpenAI மற்றும் Anthropic ஆகிய நிறுவனங்கள் ஜூலை 2026 இல் தங்கள் புதிய டெவலப்பர் சார்ந்த மாடல்களை வெளியிட்டன—OpenAI-ன் GPT-5.6 மற்றும் Anthropic-ன் Claude Fable 5—ஒவ்வொன்றும் வேகமான, புத்திசாலித்தனமான உதவியை வழங்குகின்றன. முக்கிய எண்கள் கவனிக்கத்தக்கவை: GPT-5.6-ன் மலிவான அடுக்கு (Sol) 1 மில்லியன் உள்ளீட்டு டோக்கன்களுக்கு $5 மற்றும் 1 மில்லியன் வெளியீட்டு டோக்கன்களுக்கு $30 செலவாகும், அதே நேரத்தில் Claude Fable 5 முறையே $10 மற்றும் $50 வசூலிக்கிறது.
டெவலப்பர்களுக்கு இந்த வெளியீடு ஏன் முக்கியமானது
நிறுவன மென்பொருள் (enterprise software), சாட் உதவியாளர்கள் (chat assistants) மற்றும் தன்னாட்சி முகவர்கள் (autonomous agents) ஆகியவற்றிற்கான அடுத்த தலைமுறை இயந்திரமாக இரு நிறுவனங்களும் இந்த மாடல்களை முன்வைத்துள்ளன.
விலை நிலப்பரப்பு
| மாடல் அடுக்கு (Model tier) | உள்ளீட்டு விலை (1 M டோக்கன்களுக்கு) | வெளியீட்டு விலை (1 M டோக்கன்களுக்கு) |
|---|---|---|
| GPT-5.6 Sol | $5 | $30 |
| GPT-5.6 Terra | $2.50 | $15 |
| GPT-5.6 Luna | $1 | $6 |
| Claude Fable 5 | $10 | $50 |
GPT-5.6-ன் மூன்று அடுக்குகள் டெவலப்பர்கள் தங்கள் பணிச்சுமையின் தீவிரத்திற்கு ஏற்ப செலவைச் சரிசெய்ய அனுமதிக்கின்றன. Claude Fable 5 ஒரு நிலையான விலையை வழங்குகிறது, ஆனால் பிராம்ப்ட்-கேச்சிங்கில் (prompt-caching) 90% தள்ளுபடியை வழங்குகிறது—அடிக்கடி பயன்படுத்தப்படும் பிராம்ப்ட்களை மீண்டும் செயலாக்குவதைத் தவிர்க்க சேமித்து வைக்கும் ஒரு நுட்பம் இது. உங்கள் பயன்பாடு மீண்டும் மீண்டும் கேட்கப்படும் கேள்விகளைச் சார்ந்தது என்றால், அந்தத் தள்ளுபடி செலவு இடைவெளியைக் குறைக்கும், ஆனால் அது அதிக அடிப்படை விலையை நீக்கிவிடாது.
பெஞ்ச்மார்க் செயல்திறன் ஒரு பார்வையில்
- பொது அறிவுத் திறன் (Artificial Analysis Index) – Claude Fable 5 59.9 புள்ளிகளையும், GPT-5.6 Sol 58.9 புள்ளிகளையும் பெறுகிறது. தூய தர்க்க ரீதியான சோதனைகளில் (reasoning tests) இவை இரண்டும் சமமான நிலையில் உள்ளன.
- தொழில்முறை பணிப்பாய்வுகள் (Agents’ Last Exam) – GPT-5.6 Sol 53.6% ஐ எட்டுகிறது, ஆனால் Claude Fable 5 40.5% மட்டுமே எட்டுகிறது. நிஜ உலக வணிகச் செயல்பாடுகளைப் பிரதிபலிக்கும் பல படிநிலைத் பணிகளில் (multi-step tasks), GPT-5.6 முன்னிலையில் உள்ளது.
- நிஜ உலக கோடிங் (SWE-Bench Pro) – Claude Fable 5 80% ஐ எட்டுகிறது, அதே சமயம் GPT-5.6 Sol 64.6% ஐ எட்டுகிறது. பெரிய குறியீட்டுத் தொகுப்புகள் (codebases) மற்றும் சிக்கலான மென்பொருள் பொறியியல் பிராம்ப்ட்களுக்கு, Claude தெளிவான முன்னிலையைக் காட்டுகிறது.
இந்த எண்கள் மாடலின் பல்வேறு திறன்களைச் சோதிக்கும் பொதுவான பெஞ்ச்மார்க் தொகுப்புகளிலிருந்து பெறப்பட்டவை. “Artificial Analysis Index” என்பது சுருக்கமான தர்க்க ரீதியான சிந்தனையை (abstract reasoning) அளவிடுகிறது; “Agents’ Last Exam” என்பது கருவிகள் மூலம் செயல்களைத் தொடர்ச்சியாகச் செய்யும் மாடலின் திறனைச் சோதிக்கிறது; “SWE-Bench Pro” என்பது நிஜ உலக நிரலாக்கப் பிரச்சனைகளில் குறியீடு உருவாக்கும் தரத்தை (code generation quality) மதிப்பிடுகிறது.
ஒவ்வொரு மாடலும் எதில் சிறந்து விளங்குகிறது
நீங்கள் இதைப் பயன்படுத்த GPT-5.6-ஐத் தேர்ந்தெடுக்கவும்:
- அதிக கோரிக்கைகளை (request volumes) கையாளும் போது, API செலவைக் குறைவாக வைத்திருக்க வேண்டியிருந்தால்.
- OpenAI தனது “ultra mode”-இல் ஒருங்கிணைத்துள்ள இணையத் தேடல் (web browsing) அல்லது கணினிப் பயன்பாட்டு பிளகின்களை (computer-use plugins) நம்பியிருந்தால்.
- செலவு வரம்புகளைத் தாண்டாமல் நான்கு தன்னாட்சி முகவர்களை (autonomous agents) இணையாக இயக்க விரும்பினால்.
நீங்கள் இதைப் பயன்படுத்த Claude Fable 5-ஐத் தேர்ந்தெடுக்கவும்:
- மனிதத் தலையீடு இன்றி பல நாட்களுக்குத் தொடர்ச்சியாக இயங்கக்கூடிய ஆழமான, தன்னாட்சி கோடிங் அமர்வுகள் (autonomous coding sessions) தேவைப்பட்டால்.
- அடர்த்தியான ஆவணங்கள், சிக்கலான வரைபடங்கள் அல்லது விளக்கப்படங்கள் நிறைந்த தரவுகளுடன் பணிபுரிந்தால் (இவற்றை Claude சிறப்பாகக் கையாளும் திறன் கொண்டது).
- Anthropic தனது நிறுவன வெளியீட்டில் வலியுறுத்தியுள்ளபடி, AWS அல்லது Google Cloud உடன் நேரடி இணைப்புகளை (native hooks) விரும்பினால்.
நீங்கள் உறுதிப்படுத்துவதற்கு முன் செய்ய வேண்டிய நடைமுறைப் படிகள்
- உங்கள் சொந்தத் தரவைக் கொண்டு ஒரு முன்னோடிச் சோதனையை (pilot) நடத்துங்கள். பெஞ்ச்மார்க்குகள் பயனுள்ளவை, ஆனால் அவை உங்கள் குறிப்பிட்ட பிராம்ப்ட்கள், தரவு வடிவங்கள் மற்றும் தாமதத் தேவைகளின் (latency requirements) தனித்துவத்தைப் பிரதிபலிக்க முடியாது.
- மாடல் கேச்சிங் செலவுகள் முக்கியம். Claude-ன் 90% தள்ளுபடி கேச் செய்யப்பட்ட (cached) பிராம்ப்ட்களுக்கு மட்டுமே பொருந்தும்; நீங்கள் எதிர்பார்க்கும் சேமிப்பு மற்றும் கேச்-மிஸ் விகிதத்தைக் (cache-miss rate) கணக்கில் கொள்ளுங்கள்.
- பிராண்டை விட பணியிற்கு ஏற்ற மாடலைத் தேர்ந்தெடுங்கள். அதிகத் திறன் கொண்ட, செலவு சார்ந்த பணிகளுக்கு GPT-5.6-ஐப் பயன்படுத்துங்கள்; கோடிங் அல்லது ஆவணங்கள் சார்ந்த பணிகளுக்கு Claude-க்கு மாறவும்.
தவிர்க்க வேண்டிய தவறுகள்
- ஒரே ஒரு பெஞ்ச்மார்க்கை மட்டும் நம்பியிருக்க வேண்டாம். ஒவ்வொரு சோதனையும் ஒரு குறிப்பிட்ட திறனை மட்டுமே அளவிடுகிறது; ஒரு மாடல் ஒன்றில் சிறந்து விளங்கலாம், ஆனால் மற்றொன்றில் பின்தங்கலாம்.
இறுதி முடிவு
GPT-5.6 மற்றும் Claude Fable 5 ஆகியவற்றுக்கு இடையே ஒரு பொதுவான வெற்றியாளர் இல்லை. உங்கள் விருப்பத்தைப் பொறுத்தே தேர்வு அமையும்: செலவுத் திறன் மற்றும் இணையாக முகவர்களை இயக்குவதா, அல்லது சிறந்த குறியீடு உருவாக்கம் மற்றும் ஆழமான ஆவணங்களைக் கையாளுவதா. உங்கள் உண்மையான பணிச்சுமைகளுக்கு எதிராக இரண்டையும் சோதித்துப் பாருங்கள், கேச்சிங் மற்றும் அளவுத் தள்ளுபடிகளைக் கணக்கில் கொள்ளுங்கள், மேலும் பிராண்ட் விசுவாசத்தை விட எண்களின் அடிப்படையில் முடிவெடுங்கள்.
