GPT-5.6 Sol از OpenAI با کارایی برتر، Fable 5 را به چالش می‌کشد

OpenAI با عرضه GPT-5.6 Sol، یک مدل پرچم‌دار که هوش تقریباً هم‌تراز با مدل‌های پیشرو را با کسری از هزینه‌ها ارائه می‌دهد، رسماً سلسله‌مراتب مدل‌های مرزی (frontier models) را دگرگون کرد. OpenAI با بهینه‌سازی رابطه بین عملکرد و قیمت‌گذاری، استاندارد جدیدی را برای جریان‌های کاری مبتنی بر عامل (agentic workflows) و استقرار در مقیاس سازمانی تعیین می‌کند.

شکستن بنچمارک‌ها: تسلط بر کدنویسی و هم‌ترازی هوش

داده‌های جدید از پلتفرم ارزیابی مستقل Artificial Analysis نشان می‌دهد که GPT-5.6 Sol (max) در تعقیب مدل‌های سطح‌بالای Anthropic است. در شاخص هوش (Intelligence Index)، مدل Sol به امتیاز ۵۹ دست یافت و تنها یک امتیاز از Claude Fable 5 عقب ماند. این امر آن را از دیگر غول‌های این حوزه مانند Claude Opus 4.8 (با ۵۶ امتیاز) و GPT-5.6 Terra (با ۵۵ امتیاز) جلو می‌اندازد.

در حالی که Fable 5 برتری اندکی در هوش عمومی کلی حفظ کرده است، OpenAI در حوزه‌های تخصصی به پیروزی آشکاری دست یافته است. در شاخص جدید عامل کدنویسی (Coding Agent Index)، مدل GPT-5.6 Sol هنگام اجرا در محیط Codex شرکت OpenAI، با کسب ۸۰ امتیاز در جایگاه نخست قرار گرفت و از هر دو مدل GPT-5.6 Terra (۷۷ امتیاز) و Claude Fable 5 (۷۷ امتیاز) پیشی گرفت. علاوه بر این، در بنچمارک AA-Briefcase — که عملکرد در وظایف واقع‌گرایانه اداری را اندازه‌گیری می‌کند — مدل Sol بالاترین امتیاز "Presentation Elo" را در میان تمام مدل‌های آزمایش‌شده کسب کرد.

مرز پارتو جدید: کاهش شدید هزینه‌ها

مهم‌ترین تأثیر عرضه GPT-5.6 در کارایی اقتصادی آن نهفته است. Artificial Analysis خاطرنشان می‌کند که Sol «مرز پارتوی جدیدی از هوش در مقابل توکن‌های خروجی در هر وظیفه را تعریف می‌کند.» در حالی که هزینه Claude Fable 5 تقریباً ۲.۷۵ دلار برای هر وظیفه است، GPT-5.6 Sol با هزینه تنها ۱.۰۴ دلار — یعنی تقریباً یک‌سوم قیمت — عملکردی مشابه ارائه می‌دهد.

OpenAI همچنین یک اکوسیستم چندسطحی را برای پاسخگویی به مقیاس‌های مختلف پیچیدگی معرفی کرده است:

  • GPT-5.6 Sol: ۵ دلار به ازای هر میلیون توکن ورودی / ۳۰ دلار به ازای هر میلیون توکن خروجی.
  • GPT-5.6 Terra: ۲.۵۰ دلار به ازای هر میلیون توکن ورودی / ۱۵ دلار به ازای هر میلیون توکن خروجی (۵۰٪ ارزان‌تر از Sol).
  • GPT-5.6 Luna: ۱ دلار به ازای هر میلیون توکن ورودی / ۶ دلار به ازای هر میلیون توکن خروجی (۸۰٪ ارزان‌تر از Sol).

برای کاهش بیشتر تأخیر (latency) و هزینه در جریان‌های کاری تکراری، OpenAI یک هزینه نوشتن در حافظه پنهان (cache-write fee) معرفی کرده و تخفیف عظیم ۹۰ درصدی برای خواندن از حافظه پنهان (cache reads) ارائه داده است. علاوه بر این، Sam Altman، مدیرعامل شرکت، خاطرنشان کرد که Sol در مصرف توکن بسیار کارآمدتر است و در وظایف کدنویسی مبتنی بر عامل، تا ۵۴٪ توکن خروجی کمتری نسبت به مدل‌های مشابه مصرف می‌کند.

تشدید جنگ جهانی قیمت‌ها

این عرضه نشان‌دهنده یک تغییر استراتژیک در مسابقه تسلیحاتی هوش مصنوعی است. در حالی که مدل‌های متن‌باز چینی، Muse 1.1 از Meta و Grok 4.5 از xAI فشار کاهشی بر حاشیه سود وارد می‌کنند، OpenAI دیگر تنها بر سر هوش خالص رقابت نمی‌کند، بلکه بر سر اقتصاد واحد (unit economics) در حال رقابت است.

OpenAI با تحت فشار قرار دادن Anthropic هم از نظر عملکرد و هم از نظر قیمت، تکاملی در کل بازار را تحمیل می‌کند. اگرچه این «رقابت برای رسیدن به پایین‌ترین قیمت» به نفع توسعه‌دهندگان و بنیان‌گذارانی است که به دنبال مقیاس‌پذیری برنامه‌های مبتنی بر عامل هستند، اما فضای رقابتی شدیدی ایجاد می‌کند که تعیین خواهد کرد کدام آزمایشگاه‌های هوش مصنوعی در بلندمدت پایدار باقی می‌مانند.

نکات کلیدی

  • هم‌ترازی عملکرد: GPT-5.6 Sol در شاخص هوش تنها با یک اختلاف امتیاز با Claude Fable 5 برابری می‌کند و با کسب ۸۰ امتیاز، بر شاخص عامل کدنویسی (Coding Agent Index) تسلط دارد.
  • تحول اقتصادی: Sol هوشی در سطح مدل‌های مرزی را با یک‌سوم هزینه Fable 5 ارائه می‌دهد (۱.۰۴ دلار در مقابل ۲.۷۵ دلار برای هر وظیفه).
  • کارایی مبتنی بر عامل: بهینه‌سازی‌های جدید، از جمله ۹۰٪ تخفیف در خواندن از حافظه پنهان و مصرف ۵۴٪ توکن خروجی کمتر برای کدنویسی، Sol را برای عامل‌های خودمختار بسیار بهینه کرده است.