Sakana AI का Fugu Ultra v1.1 नवीनतम अपडेट में Fable 5 से बेहतर प्रदर्शन करता है
Sakana AI ने अपने इंटेलिजेंट मॉडल राउटर, Fugu Ultra v1.1 के लिए एक महत्वपूर्ण अपडेट जारी किया है, जिसमें महत्वपूर्ण तकनीकी बेंचमार्क पर प्रदर्शन में भारी उछाल का दावा किया गया है। यह अपडेट बेहतर रीजनिंग और कोडिंग क्षमताओं को प्राप्त करने के लिए शीर्ष स्तर के मॉडलों के बीच क्वेरीज़ (queries) को वितरित करने के तरीके को परिष्कृत करने का एक रणनीतिक प्रयास है।
बेंचमार्क तोड़ना: Fugu Ultra v1.1 का लाभ
Fugu Ultra v1.1 का मुख्य नवाचार इसकी रूटिंग इंटेलिजेंस (routing intelligence) में निहित है, जो किसी भी दिए गए प्रॉम्प्ट के लिए सार्वजनिक रूप से उपलब्ध LLMs के पूल में से सबसे उपयुक्त मॉडल का चयन करती है। Sakana AI की रिपोर्ट के अनुसार, यह संस्करण शुरुआती v1.0 रिलीज़ की तुलना में 7.9 अंकों तक का प्रदर्शन लाभ प्रदान करता है।
सबसे उल्लेखनीय रूप से, राउटर ने विशेष तकनीकी मूल्यांकन, विशेष रूप से ProgramBench और TerminalBench 2.1 बेंचमार्क पर महत्वपूर्ण उछाल दिखाया है। एक चौंकाने वाले दावे में, Sakana का कहना है कि Fugu Ultra v1.1 अब अधिकांश बेंचमार्क में Anthropic के Fable 5 से बेहतर प्रदर्शन करता है—भले ही Fable 5 वास्तव में राउटर के चयन पूल में शामिल नहीं है। हालांकि इन परिणामों में वर्तमान में स्वतंत्र तीसरे पक्ष के सत्यापन (third-party verification) की कमी है, लेकिन वे संकेत देते हैं कि रूटिंग लॉजिक मौजूदा मॉडल आर्किटेक्चर से चरम प्रदर्शन निकालने में अत्यधिक कुशल होता जा रहा है।
तकनीकी आर्किटेक्चर और डेवलपर इंटीग्रेशन
एक अत्याधुनिक पूल बनाए रखने के लिए Sakana का दृष्टिकोण कठोर है; कंपनी का कहना है कि किसी भी नए टॉप-टियर मॉडल को आधिकारिक तौर पर Fugu इकोसिस्टम में एकीकृत करने से पहले लगभग दो सप्ताह के समर्पित प्रशिक्षण और मूल्यांकन की आवश्यकता होती है। यह सुनिश्चित करता है कि राउटर की निर्णय लेने की प्रक्रिया बाजार में नवीनतम वेट्स (weights) और क्षमताओं के लिए अनुकूलित रहे।
डेवलपर्स के लिए, यह अपडेट एक नया Claude Code-compatible endpoint पेश करता है, जिससे उपयोगकर्ता सीधे अपने टर्मिनल से Fugu को कॉल कर सकते हैं। यह एकीकरण उन इंजीनियरों के लिए वर्कफ़्लो को सरल बनाता है जिन्हें उच्च-स्तरीय रीजनिंग और टर्मिनल-आधारित ऑटोमेशन की आवश्यकता होती है। इन तकनीकी प्रगति के बावजूद, कीमतें पिछले संस्करण के समान ही बनी हुई हैं: $5 प्रति मिलियन इनपुट टोकन और $30 प्रति मिलियन आउटपुट टोकन। Fugu वर्तमान में OpenRouter और Vercel सहित प्रमुख प्लेटफार्मों के माध्यम से सुलभ है।
बाजार की चुनौतियों और विनियमन का समाधान
यह रिलीज़ Fugu के शुरुआती लॉन्च के लिए जांच के दौर के बाद आई है। शुरुआती आलोचकों ने उच्च टोकन खपत, लेटेंसी (latency) और असंगत परिणामों के संबंध में मुद्दों पर प्रकाश डाला था। v1.1 के साथ, Sakana डेवलपर्स का भरोसा वापस जीतने के लिए दक्षता और विशेष कार्य प्रदर्शन पर अधिक ध्यान केंद्रित करता हुआ प्रतीत होता है।
हालांकि, वैश्विक स्तर पर अपनाने के लिए भौगोलिक सीमाएं एक बाधा बनी हुई हैं। Sakana AI वर्तमान में GDPR और अन्य EU-विशिष्ट नियामक ढांचे (regulatory frameworks) से जुड़ी जटिलताओं का हवाला देते हुए यूरोपीय संघ (EU) या यूरोपीय आर्थिक क्षेत्र (EEA) के भीतर उपयोगकर्ताओं को सेवा नहीं देता है। जैसे-जैसे "मॉडल राउटर" श्रेणी बढ़ रही है, पारदर्शी, सत्यापन योग्य डेटा के माध्यम से इन प्रदर्शन दावों को साबित करने की Sakana की क्षमता प्रतिस्पर्धी AI परिदृश्य में इसकी व्यवहार्यता की अंतिम परीक्षा होगी।
मुख्य बातें
- बेहतर बेंचमार्किंग: Fugu Ultra v1.1, v1.0 की तुलना में 7.9-पॉइंट का सुधार दिखाता है, और Fable 5 के राउटर के पूल में न होने के बावजूद कई मेट्रिक्स पर Anthropic के Fable 5 से बेहतर प्रदर्शन करता है।
- डेवलपर-केंद्रित अपडेट: नया संस्करण एक Claude Code-compatible टर्मिनल एंडपॉइंट जोड़ता है, जिससे कोडिंग वर्कफ़्लो के लिए आसान एकीकरण की सुविधा मिलती है।
- कठोर क्यूरेशन: उच्च सटीकता और प्रदर्शन बनाए रखने के लिए Sakana राउटर में जोड़े जाने वाले प्रत्येक नए मॉडल के लिए दो सप्ताह का मूल्यांकन चक्र अपनाता है।
