Vercel-இன் ஜூன் மாத டோக்கன்ப் பங்கு (token-share) அறிக்கை, கேட்வே டோக்கன்களில் (gateway tokens) 29% திறந்த-எடை மாதிரிகளால் (open-weight models) கையாளப்படுவதைக் காட்டுகிறது; இது ஏப்ரலில் இருந்த 11%-லிருந்து அதிகரித்துள்ளது. இதில் DeepSeek மட்டும் 22.6% பங்கைக் கொண்டுள்ளது. இந்தத் திடீர் உயர்வு ஒரு விரைவான மாற்றத்தைக் குறிக்கிறது: டெவலப்பர்கள் ஒரே ஒரு "சிறந்த" மாதிரியை மட்டும் சார்ந்திருக்காமல், AI மாதிரிகளை ஒரு ரூட்டபிள் உள்கட்டமைப்பாக (routable infrastructure) கையாளத் தொடங்கியுள்ளனர்.
டெவலப்பர்கள் ஏன் மாதிரிகளை உள்கட்டமைப்பாகக் கருதுகிறார்கள்
மலிவான, திறந்த-எடை மாதிரிகள்—பல சீன நிறுவனங்களிடமிருந்து வருகின்றன—Anthropic போன்ற பிரீமியம் சேவைகளின் ஒரு சிறு பகுதியை மட்டுமே செலவாகக் கொண்டவை. குறியீடு பிரித்தெடுத்தல் (code extraction), உரை சுத்தம் செய்தல் (text cleaning) அல்லது எளிய தரவுத் தேடல்கள் (data look-ups) போன்ற வழக்கமான பணிகளுக்கு, டாலர்களுக்குப் பதிலாகச் சில சென்ட்கள் மட்டுமே செலவாகும் ஒரு மாதிரி மிகவும் ஈர்க்கக்கூடியதாக இருக்கும், அது சில சதவீதம் துல்லியக் குறைவாக இருந்தாலும் கூட.
இதன் விளைவாக ஒரு புதிய வடிவமைப்பு முறை (design pattern) உருவாகியுள்ளது. ஒரு பயன்பாடு (application) முதலில் வேலையின் "சலிப்பூட்டும்" (boring) பகுதிக்கு ஒரு குறைந்த செலவு கொண்ட மாதிரியைத் கோரிக்கையை அனுப்புகிறது. அந்த வெளியீடு ஒரு எளிய தரப் பரிசோதனையில் தேர்ச்சி பெற்றால், செயல்முறை தொடரும்; இல்லையெனில், இரண்டாவது முறை சரிபார்க்க அல்லது இறுதி முடிவெடுக்க அதிக விலை கொண்ட மாதிரி அழைக்கப்படும். இங்கே ஒரு தனி மாதிரியைத் தேர்ந்தெடுப்பதை விட, ரூட்டிங் லாஜிக் (routing logic) தான் முக்கியமான அங்கமாக மாறுகிறது.
புள்ளிவிவரங்கள் என்ன சொல்கின்றன
பல AI நிறுவனங்களின் முன்னால் செயல்படும் தனது கேட்வேயிலிருந்து பெறப்பட்ட Vercel-இன் தரவுகள், திறந்த-எடை மாதிரிகள் ஓரங்கட்டப்பட்ட நிலையில் இருந்து முதன்மை நிலைக்கு நகர்வதைக் காட்டுகின்றன. ஏப்ரலில், அவை அனைத்து டோக்கன்களில் பத்தில் ஒரு பங்கிற்கும் குறைவாகவே இருந்தன; ஜூன் மாதத்திற்குள், அவை மூன்றில் ஒரு பங்கிற்கு நெருக்கமாக இருந்தன. சீன மாதிரியான DeepSeek, டோக்கன் அளவில் ஐந்தில் ஒரு பங்கிற்கும் மேலாகத் தனியாகப் பங்களித்துள்ளது.
உயர்நிலை மாதிரிகள் (High-end models) இன்னும் செலவில் ஆதிக்கம் செலுத்துகின்றன. உதாரணமாக, Anthropic தொடர்ந்து அதிகப்படியான பணப் பங்களிப்பைப் பெறுகிறது, ஏனெனில் அதன் டோக்கன் விலை அதிகம். இதன் கணக்கீடு எளிமையானது: மலிவான மாதிரிகள் அதிக அளவுள்ள, குறைந்த லாபம் தரும் பணிகளைச் செய்கின்றன, அதே சமயம் விலையுயர்ந்த மாதிரிகள் அதிக லாபம் மற்றும் அதிக தாக்கத்தை ஏற்படுத்தும் பணிகளைத் தக்கவைத்துக் கொள்கின்றன.
AI ஏஜென்ட்களுக்கான தாக்கங்கள்
ஒரு AI ஏஜென்ட் பொதுவாகத் திட்டமிடுதல் (planning), தரவு மீட்டெடுத்தல் (data retrieval), கருவி அழைப்பு (tool invocation) மற்றும் முடிவுகளைச் செம்மைப்படுத்துதல் (result refinement) போன்ற தொடர்ச்சியான படிகளைச் செய்கிறது. ஒவ்வொரு படிநிலையையும் மிகவும் சிக்கனமான மாதிரியிடம் ஒப்படைக்க முடியும் போது, ஒட்டுமொத்த இயக்கச் செலவு (operating cost) வியக்கத்தக்க வகையில் குறைகிறது.
- தரவு மீட்டெடுத்தல் (Data retrieval) மற்றும் பிரித்தெடுத்தல் (extraction) ஆகியவற்றிற்கு பெரும்பாலும் அடிப்படை மொழிப் புரிதல் மட்டுமே தேவைப்படுகிறது, இது மலிவான மாதிரிகள் சிறப்பாகச் செய்யும் ஒரு பணியாகும்.
- இறுதித் தீர்ப்பு (Final judgment)—பதில் ஏற்றுக்கொள்ளத்தக்கதா என்பதைத் தீர்மானிக்கும் பகுதி—அதிக நம்பகத்தன்மை கொண்ட பிரீமியம் மாதிரிகளின் களமாகவே உள்ளது.
இந்த அடுக்குமுறை அணுகுமுறை (layered approach), டெவலப்பர்கள் தங்கள் பட்ஜெட்டைத் தாண்டாமல் பெரிய அளவிலான வேலைகளைத் தானியக்கமாக்க அனுமதிக்கிறது. இது "சிறந்த மாதிரியைத் தேர்ந்தெடு" என்பதிலிருந்து "ஒவ்வொரு படியிலும் வெற்றியை அளவிட்டு அதற்கேற்ப ரூட் செய்" என்ற மாற்றத்திற்கு வழிவகுக்கிறது.
அபாயங்கள் மற்றும் வரம்புகள்
இதன் பொருளாதார ரீதியான லாபம் ஈர்க்கக்கூடியதாக இருந்தாலும், இந்த மாற்றம் தடையற்றது அல்ல.
- இணக்கம் (Compliance): சில நாடுகள் கடுமையான தரவு கையாளுதல் விதிகளை விதித்துள்ளன, இது வெளிநாடுகளில் ஹோஸ்ட் செய்யப்பட்ட மாதிரிகளின் பயன்பாட்டைக் குறைக்கலாம்.
- ஹோஸ்டிங் சிக்கல்கள் (Hosting complexity): பெரிய பிரீமியம் மாதிரிகளை உள்ளூரிலேயே (in-house) இயக்குவது கடினம், எனவே நிறுவனங்கள் வெளிப்புற API-களைச் சார்ந்திருக்க வேண்டியுள்ளது, இது லேட்டன்சி (latency) மற்றும் வெண்டர்-லாக் (vendor-lock) போன்ற கவலைகளை ஏற்படுத்தலாம்.
இந்தக் காரணங்களால், மலிவான மாதிரிகள் பிரீமியம் மாதிரிகளை முழுமையாக மாற்றியமைக்க வாய்ப்பில்லை. மாறாக, அவை வழக்கமான பணிகளுக்குத் தொடக்கப் புள்ளியாக அமையும், அதே சமயம் பிரீமியம் மாதிரிகள் அவற்றின் அதிக விலை நியாயப்படுத்தப்படும் "முடிவெடுக்கும் அடுக்கில்" (decision layer) நிலைத்திருக்கும்.
அடுத்து கவனிக்க வேண்டியவை
- ரூட்டிங்கிற்கான கருவிகள் (Tooling for routing): ரூட்டிங் அடுக்கு மையமாக மாறும்போது, லேட்டன்சி, செலவு மற்றும் நம்பிக்கையின் வரம்புகளின் (confidence thresholds) அடிப்படையில் மாதிரியைத் தானாகத் தேர்ந்தெடுக்கும் SDK-கள் மற்றும் தளங்களின் அலைகளை நாம் எதிர்பார்க்கலாம்.
பணி-நிலை வெற்றியை (task-level success) அளவிடத் தொடங்கும், மறுமுயற்சிகளைக் (retries) கண்காணிக்கும் மற்றும் "அளவு" (volume) என்பதையும் "தீர்ப்பு" (judgment) என்பதையும் தெளிவாகப் பிரிக்கும் டெவலப்பர்கள், உருவாகி வரும் இந்த உள்கட்டமைப்பு மனநிலையிலிருந்து பயனடையச் சிறந்த நிலையில் இருப்பார்கள்.
முக்கியக் கருத்து (Takeaway): AI அடுக்கு (stack) என்பது ஒரு தனி மாதிரியைத் தேர்ந்தெடுப்பதிலிருந்து, ஒரு ரூட்டிங் சிக்கலாக (routing problem) மாறி வருகிறது; இதில் மலிவான திறந்த-எடை மாதிரிகள் பெரும்பாலான வேலைகளைக் கையாளுகின்றன, பிரீமியம் மாதிரிகள் அதிக தாக்கத்தை ஏற்படுத்தும் முடிவுகளுக்காக ஒதுக்கி வைக்கப்படுகின்றன. அந்த ரூட்டிங்கில் தேர்ச்சி பெறுவதே AI உருவாக்குநர்களுக்கான அடுத்த போட்டித்திறனாக இருக்கும்.
