OpenAI GPT-5.6 Sol מאתגרת את Fable 5 עם יעילות עדיפה

OpenAI שיבשה רשמית את היררכיית מודלי הקצה עם השקת GPT-5.6 Sol, מודל דגל המספק אינטליגנציה כמעט שקולה בשבריר מהעלות. באמצעות אופטימיזציה של היחס בין ביצועים למחיר, OpenAI קובעת סטנדרט חדש עבור תהליכי עבודה סוכניים (agentic workflows) ופריסה בקנה מידה ארגוני.

שבירת מדדים: דומיננטיות בתכנות ושוויון באינטליגנציה

נתונים חדשים מפלטפורמת ההערכה העצמאית Artificial Analysis מגלים כי GPT-5.6 Sol (max) רודפת צמוד אחרי המודלים המובילים של Anthropic. במדד האינטליגנציה (Intelligence Index), Sol השיגה ציון של 59 נקודות, פער של נקודה אחת בלבד מ-Claude Fable 5. נתון זה מציב אותה לפני כבדי שם אחרים כמו Claude Opus 4.8 (56 נקודות) ו-GPT-5.6 Terra (55 נקודות).

בעוד ש-Fable 5 שומרת על יתרון קל באינטליגנציה כללית כוללת, OpenAI הבטיחה ניצחון ברור בתחומים מתמחים. במדד ה-Coding Agent Index החדש, GPT-5.6 Sol תפסה את המקום הראשון עם 80 נקודות בעת ריצה בסביבת Codex של OpenAI, תוך שהיא עוקפת הן את GPT-5.6 Terra (77 נקודות) והן את Claude Fable 5 (77 נקודות). בנוסף, במדד AA-Briefcase — המודד ביצועים במשימות משרדיות ריאליסטיות — Sol השיגה את ה-"Presentation Elo" הגבוה ביותר מבין כל המודלים שנבדקו.

חזית פארטו החדשה: הפחתות עלויות רדיקליות

ההשפעה המשמעותית ביותר של השקת GPT-5.6 טמונה ביעילות הכלכלית שלה. Artificial Analysis מציינת כי Sol "מגדירה חזית פארטו חדשה של אינטליגנציה מול טוקנים של פלט למשימה" (Intelligence vs Output Tokens per Task). בעוד ש-Claude Fable 5 עולה כ-2.75$ למשימה, GPT-5.6 Sol מתפקדת ברמה דומה תמורת 1.04$ בלבד — בערך שליש מהמחיר.

OpenAI הציגה גם מערכת אקולוגית מדורגת כדי לתת מענה לרמות שונות של מורכבות:

  • GPT-5.6 Sol: 5$ למיליון טוקני קלט / 30$ למיליון טוקני פלט.
  • GPT-5.6 Terra: 2.50$ למיליון קלט / 15$ למיליון פלט (50% זול יותר מ-Sol).
  • GPT-5.6 Luna: 1$ למיליון קלט / 6$ למיליון פלט (80% זול יותר מ-Sol).

כדי להפחית עוד יותר את השיהוי (latency) והעלות עבור תהליכי עבודה חוזרים, OpenAI הציגה עמלת כתיבה למטמון (cache-write fee) והציעה הנחה עצומה של 90% על קריאות מהמטמון (cache reads). יתרה מכך, המנכ"ל Sam Altman ציין כי Sol יעילה משמעותית בצריכת טוקנים, תוך שימוש בשיעור של עד 54% פחות טוקני פלט למשימות תכנות סוכניות בהשוואה למודלים דומים.

מלחמת מחירים עולמית מתגברת

שחרור זה מסמן שינוי אסטרטגי במירוץ החימוש של ה-AI. בעוד שמודלים בקוד פתוח סיניים, Muse 1.1 של Meta ו-Grok 4.5 של xAI מפעילים לחץ כלפי מטה על שולי הרווח, OpenAI כבר לא מתחרה רק באינטליגנציה גולמית — היא מתחרה על כלכלה ליחידה (unit economics).

באמצעות לחיצה על Anthropic הן בביצועים והן במחיר, OpenAI מאלצת אבולוציה בכלל השוק. בעוד ש"מרוץ לתחתית" זה במחירים מועיל למפתחים ומייסדים המבקשים להרחיב יישומים סוכניים, הוא יוצר נוף תחרותי עז שיקבע אילו מעבדות AI יישארו ברות-קיימא לטווח הארוך.

נקודות מפתח

  • שוויון בביצועים: GPT-5.6 Sol משתווה ל-Claude Fable 5 בפער של נקודה אחת במדד האינטליגנציה ודומיננטי במדד ה-Coding Agent Index עם 80 נקודות.
  • שיבוש כלכלי: Sol מספקת אינטליגנציה ברמת קצה בשליש מהעלות של Fable 5 (1.04$ לעומת 2.75$ למשימה).
  • יעילות סוכנית: אופטימיזציות חדשות, כולל הנחה של 90% על קריאות מהמטמון ו-54% פחות טוקני פלט לתכנות, הופכות את Sol לאופטימלית עבור סוכנים אוטונומיים.