GPT-5.6 Sol از OpenAI با کارایی برتر، Fable 5 را به چالش میکشد
OpenAI با عرضه GPT-5.6 Sol، یک مدل پرچمدار که هوش تقریباً همتراز با مدلهای پیشرو را با کسری از هزینهها ارائه میدهد، رسماً سلسلهمراتب مدلهای مرزی (frontier models) را دگرگون کرد. OpenAI با بهینهسازی رابطه بین عملکرد و قیمتگذاری، استاندارد جدیدی را برای جریانهای کاری مبتنی بر عامل (agentic workflows) و استقرار در مقیاس سازمانی تعیین میکند.
شکستن بنچمارکها: تسلط بر کدنویسی و همترازی هوش
دادههای جدید از پلتفرم ارزیابی مستقل Artificial Analysis نشان میدهد که GPT-5.6 Sol (max) در تعقیب مدلهای سطحبالای Anthropic است. در شاخص هوش (Intelligence Index)، مدل Sol به امتیاز ۵۹ دست یافت و تنها یک امتیاز از Claude Fable 5 عقب ماند. این امر آن را از دیگر غولهای این حوزه مانند Claude Opus 4.8 (با ۵۶ امتیاز) و GPT-5.6 Terra (با ۵۵ امتیاز) جلو میاندازد.
در حالی که Fable 5 برتری اندکی در هوش عمومی کلی حفظ کرده است، OpenAI در حوزههای تخصصی به پیروزی آشکاری دست یافته است. در شاخص جدید عامل کدنویسی (Coding Agent Index)، مدل GPT-5.6 Sol هنگام اجرا در محیط Codex شرکت OpenAI، با کسب ۸۰ امتیاز در جایگاه نخست قرار گرفت و از هر دو مدل GPT-5.6 Terra (۷۷ امتیاز) و Claude Fable 5 (۷۷ امتیاز) پیشی گرفت. علاوه بر این، در بنچمارک AA-Briefcase — که عملکرد در وظایف واقعگرایانه اداری را اندازهگیری میکند — مدل Sol بالاترین امتیاز "Presentation Elo" را در میان تمام مدلهای آزمایششده کسب کرد.
مرز پارتو جدید: کاهش شدید هزینهها
مهمترین تأثیر عرضه GPT-5.6 در کارایی اقتصادی آن نهفته است. Artificial Analysis خاطرنشان میکند که Sol «مرز پارتوی جدیدی از هوش در مقابل توکنهای خروجی در هر وظیفه را تعریف میکند.» در حالی که هزینه Claude Fable 5 تقریباً ۲.۷۵ دلار برای هر وظیفه است، GPT-5.6 Sol با هزینه تنها ۱.۰۴ دلار — یعنی تقریباً یکسوم قیمت — عملکردی مشابه ارائه میدهد.
OpenAI همچنین یک اکوسیستم چندسطحی را برای پاسخگویی به مقیاسهای مختلف پیچیدگی معرفی کرده است:
- GPT-5.6 Sol: ۵ دلار به ازای هر میلیون توکن ورودی / ۳۰ دلار به ازای هر میلیون توکن خروجی.
- GPT-5.6 Terra: ۲.۵۰ دلار به ازای هر میلیون توکن ورودی / ۱۵ دلار به ازای هر میلیون توکن خروجی (۵۰٪ ارزانتر از Sol).
- GPT-5.6 Luna: ۱ دلار به ازای هر میلیون توکن ورودی / ۶ دلار به ازای هر میلیون توکن خروجی (۸۰٪ ارزانتر از Sol).
برای کاهش بیشتر تأخیر (latency) و هزینه در جریانهای کاری تکراری، OpenAI یک هزینه نوشتن در حافظه پنهان (cache-write fee) معرفی کرده و تخفیف عظیم ۹۰ درصدی برای خواندن از حافظه پنهان (cache reads) ارائه داده است. علاوه بر این، Sam Altman، مدیرعامل شرکت، خاطرنشان کرد که Sol در مصرف توکن بسیار کارآمدتر است و در وظایف کدنویسی مبتنی بر عامل، تا ۵۴٪ توکن خروجی کمتری نسبت به مدلهای مشابه مصرف میکند.
تشدید جنگ جهانی قیمتها
این عرضه نشاندهنده یک تغییر استراتژیک در مسابقه تسلیحاتی هوش مصنوعی است. در حالی که مدلهای متنباز چینی، Muse 1.1 از Meta و Grok 4.5 از xAI فشار کاهشی بر حاشیه سود وارد میکنند، OpenAI دیگر تنها بر سر هوش خالص رقابت نمیکند، بلکه بر سر اقتصاد واحد (unit economics) در حال رقابت است.
OpenAI با تحت فشار قرار دادن Anthropic هم از نظر عملکرد و هم از نظر قیمت، تکاملی در کل بازار را تحمیل میکند. اگرچه این «رقابت برای رسیدن به پایینترین قیمت» به نفع توسعهدهندگان و بنیانگذارانی است که به دنبال مقیاسپذیری برنامههای مبتنی بر عامل هستند، اما فضای رقابتی شدیدی ایجاد میکند که تعیین خواهد کرد کدام آزمایشگاههای هوش مصنوعی در بلندمدت پایدار باقی میمانند.
نکات کلیدی
- همترازی عملکرد: GPT-5.6 Sol در شاخص هوش تنها با یک اختلاف امتیاز با Claude Fable 5 برابری میکند و با کسب ۸۰ امتیاز، بر شاخص عامل کدنویسی (Coding Agent Index) تسلط دارد.
- تحول اقتصادی: Sol هوشی در سطح مدلهای مرزی را با یکسوم هزینه Fable 5 ارائه میدهد (۱.۰۴ دلار در مقابل ۲.۷۵ دلار برای هر وظیفه).
- کارایی مبتنی بر عامل: بهینهسازیهای جدید، از جمله ۹۰٪ تخفیف در خواندن از حافظه پنهان و مصرف ۵۴٪ توکن خروجی کمتر برای کدنویسی، Sol را برای عاملهای خودمختار بسیار بهینه کرده است.
