В июле 2026 года OpenAI и Anthropic представили свои новейшие модели, ориентированные на разработчиков: GPT-5.6 от OpenAI и Claude Fable 5 от Anthropic. Каждая из них обещает более быстрое и умное сопровождение в масштабируемом режиме. Ключевые цифры имеют значение: самый дешевый уровень GPT-5.6 (Sol) стоит $5 за 1 миллион входных токенов и $30 за 1 миллион выходных токенов, в то время как Claude Fable 5 берет $10 и $50 соответственно.

Почему этот запуск важен для разработчиков

Обе компании позиционируют эти модели как движки следующего поколения для корпоративного ПО, чат-ассистентов и автономных агентов.

Ценовая ситуация

Уровень модели Цена за вход (за 1 млн токенов) Цена за выход (за 1 млн токенов)
GPT-5.6 Sol $5 $30
GPT-5.6 Terra $2.50 $15
GPT-5.6 Luna $1 $6
Claude Fable 5 $10 $50

Три уровня GPT-5.6 позволяют разработчикам сопоставить стоимость с интенсивностью рабочей нагрузки. Claude Fable 5 предлагает единую цену, но добавляет 90% скидку на кэширование промптов (prompt-caching) — механизм, который сохраняет часто используемые запросы, чтобы избежать их повторной обработки. Если ваш сценарий использования связан с повторяющимися запросами, эта скидка сокращает разрыв в стоимости, но не устраняет более высокие базовые тарифы.

Обзор производительности в бенчмарках

  • Общий интеллект (Artificial Analysis Index) — Claude Fable 5 набирает 59.9, GPT-5.6 Sol — 58.9. В тестах на чистое рассуждение они идут практически вровень.
  • Профессиональные рабочие процессы (Agents’ Last Exam) — GPT-5.6 Sol достигает 53.6% против 40.5% у Claude Fable 5. В многоэтапных задачах, имитирующих реальные бизнес-процессы, GPT-5.6 вырывается вперед.
  • Программирование в реальных условиях (SWE-Bench Pro) — Claude Fable 5 достигает 80%, в то время как GPT-5.6 Sol показывает 64.6%. Для больших кодовых баз и сложных запросов в области программной инженерии Claude демонстрирует явное преимущество.

Эти цифры взяты из публичных наборов бенчмарков, которые проверяют различные аспекты возможностей моделей. «Artificial Analysis Index» измеряет абстрактное мышление; «Agents’ Last Exam» проверяет способность модели выстраивать цепочки действий с использованием различных инструментов; «SWE-Bench Pro» оценивает качество генерации кода при решении реальных задач программирования.

В чем сильные стороны каждой модели

Выбирайте GPT-5.6, если вам нужно:

  • Минимизировать расходы на API, особенно при масштабировании до больших объемов запросов.
  • Использовать плагины для веб-серфинга или управления компьютером (computer-use), которые OpenAI интегрировала в свой «ultra mode».
  • Запускать четыре автономных агента параллельно, не упираясь в потолок затрат.

Выбирайте Claude Fable 5, если вам нужно:

  • Проводить глубокие автономные сессии программирования, которые могут длиться днями без вмешательства человека.
  • Работать с плотными документами, сложными графиками или данными с обилием диаграмм, с которыми Claude, судя по всему, справляется лучше.
  • Использовать нативные интеграции с AWS или Google Cloud, на чем Anthropic сделала акцент при развертывании для корпоративного сектора.

Практические шаги перед принятием решения

  1. Проведите пилотный проект на своих данных. Бенчмарки полезны, но они не могут воспроизвести особенности ваших конкретных промптов, форматов данных и требований к задержке (latency).
  2. Учитывайте стоимость кэширования моделей. 90% скидка Claude применяется только к кэшированным промптам; закладывайте в расчет расходы на хранение и частоту промахов кэша (cache-miss rate).
  3. Подбирайте модель под задачу, а не под бренд. Используйте GPT-5.6 для высокопроизводительных и чувствительных к стоимости нагрузок; переключайтесь на Claude для задач, требующих интенсивного программирования или работы с документами.

Ловушки, которых следует избегать

  • Не полагайтесь на один бенчмарк. Каждый тест изолирует лишь часть возможностей; модель, которая преуспевает в одном, может отставать в другом.

Итог

Между GPT-5.6 и Claude Fable 5 нет универсального победителя. Выбор зависит от того, что для вас важнее: экономическая эффективность и параллельное выполнение агентов или превосходная генерация кода и глубокая обработка документов. Протестируйте обе модели на своих реальных рабочих нагрузках, учтите кэширование и скидки за объем, и пусть решение диктуют цифры, а не лояльность к бренду.