30 июля 2026 года OpenAI объявила, что использование API GPT-5.6 будет стоить значительно дешевле, чем у предшественника. Компания представила три уровня моделей — Sol, Terra и Luna — а также значительные скидки на чтение из кэша.
Почему новое ценообразование имеет значение
С момента запуска GPT-5 расходы на API стали основной статьей затрат для всех, кто создает разговорных агентов, конвейеры генерации с дополненной выборкой (RAG) или инструменты для крупномасштабного извлечения данных. Снизив стоимость входных токенов до $5, $2 и $0,20 за миллион токенов для Sol, Terra и Luna соответственно, OpenAI предоставляет разработчикам более дешевый способ выбора необходимого уровня рассуждений без необходимости перестраивать весь стек технологий. Наибольшая экономия наблюдается для Terra, стоимость которой теперь составляет 40 % от цены прежней флагманской модели, и Luna, цена которой составляет всего 4 % от этого показателя.
Разбор трех моделей
| Модель | Цена за вход (за 1 млн токенов) | Цена за выход (за 1 млн токенов) | Типичное использование |
|---|---|---|---|
| Sol | $5 | $30 | Глубокие рассуждения, задачи с цепочкой мыслей (chain-of-thought) |
| Terra | $2 | $12 | Продуктовые нагрузки, сбалансированная производительность |
| Luna | $0,20 | $1,20 | Большие объемы, простое извлечение или классификация |
Sol остается самой дорогой моделью, но предлагает самую глубокую проработку рассуждений. Terra позиционируется как стандарт для большинства приложений, в то время как Luna — это вариант для «высоких масштабов», где глубиной можно пожертвовать ради экономии.
Кэширование еще больше снижает расходы
OpenAI представила уровень кэширования, который дает скидку 90 % на операции чтения. Тарифы для кэшированных входных данных:
- Sol: $0,50 / млн токенов
- Terra: $0,20 / млн токенов
- Luna: $0,02 / млн токенов
Запись в кэш стоит в 1,25 раза дороже соответствующего тарифа на входные данные, а запись в кэше должна храниться не менее 30 минут, прежде чем она может быть удалена.
Надбавки за длину контекста заставляют быть внимательными
Теперь API вводит надбавку, если запрос превышает 272 тыс. входных токенов. Базовая цена на вход удваивается, а на выход увеличивается в 1,5 раза. Тарифы Sol за превышение составляют $10 за вход и $45 за выход за миллион токенов, что позволяет легко рассчитать переплату за необычно длинные контексты.
Что теряют разработчики
Снижение цен сопровождается двумя заметными упущениями. Во-первых, нет постоянного бесплатного уровня (free tier), а значит, каждый запрос будет платным, каким бы маленьким он ни был. Во-вторых, OpenAI еще не ввела скидки на пакетную обработку (batch-endpoint) для GPT-5.6 — функцию, которая помогала крупным пользователям снижать стоимость одного вызова в предыдущих версиях.
Как снизить расходы
- Выбирайте правильную модель: используйте Sol только для задач, действительно требующих глубоких рассуждений; для большинства рабочих задач по умолчанию выбирайте Terra; резервируйте Luna для высокопроизводительных задач низкой сложности.
- Используйте кэширование: сохраняйте промпты и промежуточные результаты, которые используются повторно; скидка 90 % на чтение может значительно перекрыть базовое снижение цены.
- Следите за длиной контекста: разбивайте очень длинные входные данные на более мелкие части или обрезайте второстепенные фрагменты, чтобы избежать двукратной надбавки за вход.
- Следите за временем жизни кэша: минимальная длительность кэширования составляет 30 минут.
Что дальше
Разработчикам следует следить за официальной страницей с тарифами на предмет любых изменений, особенно в части стоимости записи в кэш или пороговых значений длины контекста.
Итог: Многоуровневое ценообразование GPT-5.6 и агрессивные скидки на кэширование делают эту модель OpenAI доступной, однако отсутствие бесплатного уровня и пакетных скидок означает, что грамотное управление расходами по-прежнему будет иметь решающее значение для любого масштабного развертывания.
