Sakana AI નું Fugu Ultra v1.1 લેટેસ્ટ અપડેટમાં Fable 5 કરતા વધુ સારું પ્રદર્શન કરી રહ્યું છે

Sakana AI એ તેના ઇન્ટેલિજન્ટ મોડલ રાઉટર, Fugu Ultra v1.1 માટે એક મહત્વપૂર્ણ અપડેટ બહાર પાડ્યું છે, જેમાં મહત્વપૂર્ણ ટેકનિકલ બેન્ચમાર્ક પર પ્રદર્શનમાં મોટો ઉછાળો આવવાનો દાવો કરવામાં આવ્યો છે. આ અપડેટ શ્રેષ્ઠ રીઝનિંગ અને કોડિંગ ક્ષમતાઓ પ્રાપ્ત કરવા માટે ટોપ-ટિયર મોડલ્સ વચ્ચે ક્વેરીઝ કેવી રીતે વિતરિત કરવામાં આવે છે તેને સુધારવાનો એક વ્યૂહાત્મક પ્રયાસ છે.

બેન્ચમાર્ક તોડતા: Fugu Ultra v1.1 નો ફાયદો

Fugu Ultra v1.1 નું મુખ્ય ઇનોવેશન તેની રાઉટિંગ ઇન્ટેલિજન્સમાં રહેલું છે, જે કોઈપણ આપેલ પ્રોમ્પ્ટ માટે ઉપલબ્ધ LLMs ના સમૂહમાંથી સૌથી યોગ્ય મોડલ પસંદ કરે છે. Sakana AI એ અહેવાલ આપ્યો છે કે આ વર્ઝન પ્રારંભિક v1.0 રિલીઝ કરતા 7.9 પોઈન્ટ્સ સુધીનો પ્રદર્શન વધારો આપે છે.

સૌથી નોંધપાત્ર રીતે, રાઉટરે વિશિષ્ટ ટેકનિકલ મૂલ્યાંકનોમાં, ખાસ કરીને ProgramBench અને TerminalBench 2.1 બેન્ચમાર્ક પર નોંધપાત્ર ઉછાળો દર્શાવ્યો છે. એક આશ્ચર્યજનક દાવા સાથે, Sakana એ ભારપૂર્વક જણાવ્યું છે કે Fugu Ultra v1.1 હવે મોટાભાગના બેન્ચમાર્ક્સમાં Anthropic ના Fable 5 કરતા વધુ સારું પ્રદર્શન કરે છે—જોકે Fable 5 ખરેખર રાઉટરના સિલેક્શન પૂલમાં સામેલ નથી. જોકે આ પરિણામોમાં હાલમાં સ્વતંત્ર તૃતીય-પક્ષ વેરિફિકેશનની કમી છે, પરંતુ તે સૂચવે છે કે રાઉટિંગ લોજિક હાલના મોડલ આર્કિટેક્ચર્સમાંથી શ્રેષ્ઠ પ્રદર્શન મેળવવામાં અત્યંત કાર્યક્ષમ બની રહ્યું છે.

ટેકનિકલ આર્કિટેક્ચર અને ડેવલપર ઇન્ટિગ્રેશન

કટિંગ-એજ પૂલ જાળવી રાખવા માટે Sakana નો અભિગમ કડક છે; કંપની જણાવે છે કે કોઈપણ નવા ટોપ-ટિયર મોડલને સત્તાવાર રીતે Fugu ઇકોસિસ્ટમમાં સામેલ કરતા પહેલા અંદાજે બે અઠવાડિયાના સમર્પિત તાલીમ અને મૂલ્યાંકનની જરૂર પડે છે. આ સુનિશ્ચિત કરે છે કે રાઉટરની નિર્ણય લેવાની પ્રક્રિયા બજારમાં ઉપલબ્ધ લેટેસ્ટ વેટ્સ (weights) અને ક્ષમતાઓ માટે ઓપ્ટિમાઇઝ્ડ રહે.

ડેવલપર્સ માટે, આ અપડેટ એક નવું Claude Code-compatible endpoint રજૂ કરે છે, જે વપરાશકર્તાઓને તેમના ટર્મિનલમાંથી સીધું Fugu ને કોલ કરવાની મંજૂરી આપે છે. આ ઇન્ટિગ્રેશન એ એન્જિનિયરો માટે વર્કફ્લોને સરળ બનાવે છે જેમને હાઇ-લેવલ રીઝનિંગ અને ટર્મિનલ-આધારિત ઓટોમેશનની જરૂર હોય છે. આ ટેકનિકલ પ્રગતિ છતાં, કિંમત અગાઉના વર્ઝન જેવી જ છે: $5 પ્રતિ મિલિયન ઇનપુટ ટોકન્સ અને $30 પ્રતિ મિલિયન આઉટપુટ ટોકન્સ. Fugu હાલમાં OpenRouter અને Vercel સહિતના મુખ્ય પ્લેટફોર્મ્સ દ્વારા ઉપલબ્ધ છે.

બજારના પડકારો અને નિયમનનો ઉકેલ

આ રિલીઝ Fugu ના પ્રારંભિક લોન્ચ પછીના તપાસના સમયગાળા પછી આવી છે. શરૂઆતના ટીકાકારોએ વધુ પડતા ટોકન વપરાશ, લેટન્સી અને અસંગત પરિણામો અંગેના મુદ્દાઓ પર પ્રકાશ પાડ્યો હતો. v1.1 સાથે, Sakana ડેવલપરનો વિશ્વાસ પાછો મેળવવા માટે કાર્યક્ષમતા અને વિશિષ્ટ કાર્ય પ્રદર્શન પર વધુ ધ્યાન કેન્દ્રિત કરી રહ્યું હોય તેવું લાગે છે.

જોકે, વૈશ્વિક સ્તરે સ્વીકૃતિ માટે ભૌગોલિક મર્યાદાઓ હજુ પણ એક અવરોધ છે. Sakana AI હાલમાં GDPR અને અન્ય EU-વિશિષ્ટ નિયમનકારી માળખાઓની જટિલતાઓને ટાંકીને યુરોપિયન યુનિયન (EU) અથવા યુરોપિયન ઇકોનોમિક એરિયા (EEA) ના વપરાશકર્તાઓને સેવા આપતું નથી. જેમ જેમ "મોડલ રાઉટર" કેટેગરી વધતી જાય છે, તેમ તેમ પારદર્શક અને વેરિફાઇ કરી શકાય તેવા ડેટા દ્વારા આ પ્રદર્શનના દાવાઓને સાબિત કરવાની Sakana ની ક્ષમતા સ્પર્ધાત્મક AI લેન્ડસ્કેપમાં તેની વ્યવહારિકતાની અંતિમ કસોટી હશે.

મુખ્ય મુદ્દાઓ

  • શ્રેષ્ઠ બેન્ચમાર્કિંગ: Fugu Ultra v1.1 એ v1.0 ની સરખામણીમાં 7.9 પોઈન્ટનો સુધારો દર્શાવ્યો છે, જે Fable 5 રાઉટરના પૂલમાં ન હોવા છતાં ઘણા મેટ્રિક્સ પર Anthropic ના Fable 5 કરતા નોંધપાત્ર રીતે વધુ સારું પ્રદર્શન કરે છે.
  • ડેવલપર-કેન્દ્રિત અપડેટ્સ: નવું વર્ઝન Claude Code-compatible ટર્મિનલ એન્ડપોઈન્ટ ઉમેરે છે, જે કોડિંગ વર્કફ્લો માટે સરળ ઇન્ટિગ્રેશનની સુવિધા આપે છે.
  • કડક ક્યુરેશન: ઉચ્ચ ચોકસાઈ અને પ્રદર્શન જાળવી રાખવા માટે Sakana રાઉટરમાં ઉમેરવામાં આવતા દરેક નવા મોડલ માટે બે અઠવાડિયાના મૂલ્યાંકન ચક્રનો ઉપયોગ કરે છે.