В июле 2026 года OpenAI и Anthropic представили свои новейшие модели, ориентированные на разработчиков: GPT-5.6 от OpenAI и Claude Fable 5 от Anthropic. Каждая из них обещает более быстрое и умное сопровождение в масштабируемом режиме. Ключевые цифры имеют значение: самый дешевый уровень GPT-5.6 (Sol) стоит $5 за 1 миллион входных токенов и $30 за 1 миллион выходных токенов, в то время как Claude Fable 5 берет $10 и $50 соответственно.
Почему этот запуск важен для разработчиков
Обе компании позиционируют эти модели как движки следующего поколения для корпоративного ПО, чат-ассистентов и автономных агентов.
Ценовая ситуация
| Уровень модели | Цена за вход (за 1 млн токенов) | Цена за выход (за 1 млн токенов) |
|---|---|---|
| GPT-5.6 Sol | $5 | $30 |
| GPT-5.6 Terra | $2.50 | $15 |
| GPT-5.6 Luna | $1 | $6 |
| Claude Fable 5 | $10 | $50 |
Три уровня GPT-5.6 позволяют разработчикам сопоставить стоимость с интенсивностью рабочей нагрузки. Claude Fable 5 предлагает единую цену, но добавляет 90% скидку на кэширование промптов (prompt-caching) — механизм, который сохраняет часто используемые запросы, чтобы избежать их повторной обработки. Если ваш сценарий использования связан с повторяющимися запросами, эта скидка сокращает разрыв в стоимости, но не устраняет более высокие базовые тарифы.
Обзор производительности в бенчмарках
- Общий интеллект (Artificial Analysis Index) — Claude Fable 5 набирает 59.9, GPT-5.6 Sol — 58.9. В тестах на чистое рассуждение они идут практически вровень.
- Профессиональные рабочие процессы (Agents’ Last Exam) — GPT-5.6 Sol достигает 53.6% против 40.5% у Claude Fable 5. В многоэтапных задачах, имитирующих реальные бизнес-процессы, GPT-5.6 вырывается вперед.
- Программирование в реальных условиях (SWE-Bench Pro) — Claude Fable 5 достигает 80%, в то время как GPT-5.6 Sol показывает 64.6%. Для больших кодовых баз и сложных запросов в области программной инженерии Claude демонстрирует явное преимущество.
Эти цифры взяты из публичных наборов бенчмарков, которые проверяют различные аспекты возможностей моделей. «Artificial Analysis Index» измеряет абстрактное мышление; «Agents’ Last Exam» проверяет способность модели выстраивать цепочки действий с использованием различных инструментов; «SWE-Bench Pro» оценивает качество генерации кода при решении реальных задач программирования.
В чем сильные стороны каждой модели
Выбирайте GPT-5.6, если вам нужно:
- Минимизировать расходы на API, особенно при масштабировании до больших объемов запросов.
- Использовать плагины для веб-серфинга или управления компьютером (computer-use), которые OpenAI интегрировала в свой «ultra mode».
- Запускать четыре автономных агента параллельно, не упираясь в потолок затрат.
Выбирайте Claude Fable 5, если вам нужно:
- Проводить глубокие автономные сессии программирования, которые могут длиться днями без вмешательства человека.
- Работать с плотными документами, сложными графиками или данными с обилием диаграмм, с которыми Claude, судя по всему, справляется лучше.
- Использовать нативные интеграции с AWS или Google Cloud, на чем Anthropic сделала акцент при развертывании для корпоративного сектора.
Практические шаги перед принятием решения
- Проведите пилотный проект на своих данных. Бенчмарки полезны, но они не могут воспроизвести особенности ваших конкретных промптов, форматов данных и требований к задержке (latency).
- Учитывайте стоимость кэширования моделей. 90% скидка Claude применяется только к кэшированным промптам; закладывайте в расчет расходы на хранение и частоту промахов кэша (cache-miss rate).
- Подбирайте модель под задачу, а не под бренд. Используйте GPT-5.6 для высокопроизводительных и чувствительных к стоимости нагрузок; переключайтесь на Claude для задач, требующих интенсивного программирования или работы с документами.
Ловушки, которых следует избегать
- Не полагайтесь на один бенчмарк. Каждый тест изолирует лишь часть возможностей; модель, которая преуспевает в одном, может отставать в другом.
Итог
Между GPT-5.6 и Claude Fable 5 нет универсального победителя. Выбор зависит от того, что для вас важнее: экономическая эффективность и параллельное выполнение агентов или превосходная генерация кода и глубокая обработка документов. Протестируйте обе модели на своих реальных рабочих нагрузках, учтите кэширование и скидки за объем, и пусть решение диктуют цифры, а не лояльность к бренду.
