أمضت Google الأسابيع القليلة الماضية في استكمال مجموعة Gemini برسالة واضحة: السرعة والتخصص لا يقلان أهمية عن القوة الغاشمة. أطلقت الشركة ثلاثة إصدارات جديدة من Flash، كل منها مصمم لجانب مختلف من سوق المطورين. ومع كل هذا الزخم، لا يزال هناك مقعد شاغر على الطاولة؛ إذ لا يزال نموذج Gemini 3.5 Pro الرائد غائباً عن الإصدار العام، والمنافسون لا ينتظرون.

Gemini 3.6 Flash: استبدال القوة الغاشمة بالجدوى الاقتصادية

يمثل Gemini 3.6 Flash جوهر هذا الإعلان. صممت Google هذا النموذج لتحقيق مقايضة سيقبلها العديد من المطورين بكل سرور؛ فهو يضحي بالأداء الخام في ذروته مقابل تحسينات هائلة في السرعة والتكلفة. بالنسبة للفرق التي تدير وكلاء مستقلين (autonomous agents)، أو واجهات برمجة تطبيقات (APIs) عالية الإنتاجية، أو مسارات محتوى واسعة النطاق، فإن هذه المقايضة غالباً ما تكون هي الفارق بين منتج مربح ومنتج تجريبي.

مكاسب الكفاءة ملموسة. وفقاً لمؤشر Artificial Analysis، من المتوقع أن يستخدم 3.6 Flash توكنات مخرجات أقل بنسبة 17% تقريباً من سلفه 3.5 Flash. وفي اختبارات الأداء المستهدفة مثل DeepSWE، تزعم Google أن توفير التوكنات يمكن أن يصل إلى 65%. عندما تدفع مقابل كل توكن وتعالج ملايين الطلبات يومياً، فإن هذه النسب تترجم مباشرة إلى توفير في الميزانية.

تعكس الأسعار هذا التركيز على سهولة الوصول. تبلغ تكلفة توكنات المدخلات 1.50 دولار لكل مليون، بينما تبلغ تكلفة توكنات المخرجات 7.50 دولار لكل مليون. إن وكيل دعم العملاء أو مساعد مراجعة الكود الذي يعمل عبر آلاف التفاعلات في الساعة سيستهلك أموالاً أقل بكثير في هذه الفئة مقارنة بالنماذج الرائدة. كما تملك الشركات الناشئة الصغيرة والمطورون المستقلون فرصة حقيقية لبناء سير عمل قائم على الوكلاء (agentic workflows) دون استنزاف أرصدة السحابة الخاصة بهم في أسبوع واحد.

النموذج ليس أرخص فحسب، بل هو أيضاً أذكى بشكل ملحوظ في المهام القائمة على الوكلاء. ففي اختبار MLE Bench، ارتفعت الدرجات من 49.7% إلى 63.9%. وقفزت في اختبار OSWorld-Verified من 78.4% إلى 83%. هذه ليست مكاسب هامشية، بل تشير إلى أن 3.6 Flash يمكنه التخطيط وتصحيح الأخطاء وتنفيذ المهام متعددة الخطوات بموثوقية أكبر بكثير من سلفه. إذا كنت تبني مساعد بحث مستقل أو وكيل نشر (deployment agent)، فإن هذه الكفاءة الإضافية تهم أكثر من القوة النظرية القصوى.

المتخصصون: Flash-Lite و Flash Cyber

إذا كان 3.6 Flash هو النموذج الجديد متعدد الاستخدامات، فإن الإصدارين الآخرين يستهدفان نقاط ضعف محددة بتركيز جراحي.

تم بناء Gemini 3.5 Flash-Lite من أجل السرعة الخالصة. فهو يولد 350 توكن مخرجات في الثانية ويكلف 0.30 دولار فقط لكل مليون توكن مدخلات. هذا السعر يصعب تجاهله. يمكنك تشغيل واجهات دردشة في الوقت الفعلي، أو مسارات تصنيف، أو مهام استخراج بيانات عالية الحجم دون القلق من أن تتجاوز فاتورة الاستدلال (inference bill) إيراداتك.

ما يجعل Flash-Lite مثيراً للاهتمام بشكل خاص هو أنه يتفوق أحياناً على حجمه المتوقع. تشير Google إلى أنه يتفوق على نموذج Gemini 3 Flash الأكبر في بعض مهام هندسة البرمجيات القائمة على الوكلاء واستخدام الكمبيوتر. لقد قضت الصناعة سنوات في افتراض أن الأكبر هو الأفضل دائماً، لكن Flash-Lite يتحدى هذه الفكرة من خلال إثبات أن نموذجاً أصغر ومحسناً يمكنه التفوق على نموذج عام أكبر في مهام محددة. بالنسبة للمهندسين الذين يختارون نموذجاً لمهمة إنتاج ضيقة، فإن قصة التحسين هذه مقنعة للغاية.

ثم هناك Gemini 3.5 Flash Cyber. هذا ليس روبوت دردشة عاماً، بل هو متخصص أمني مدمج مباشرة في وكيل CodeMender الخاص بـ Google ومعد خصيصاً لسير عمل الأمن السيبراني. في اختبار CyberGym، سجل 83.2%، مما يضعه على مسافة قريبة من