Anthropic представляет Claude Opus 5: элитная производительность вдвое дешевле
Anthropic официально запустила Claude Opus 5 — новую флагманскую модель, призванную перевернуть рынок высокопроизводительных LLM, предлагая возможности, почти идентичные премиальной Claude Fable 5, но по значительно более низкой цене. Этот стратегический шаг направлен на нейтрализацию ценового давления со стороны таких конкурентов, как GPT-5.6 Sol, и предоставление разработчикам более эффективного инструмента для написания кода и сложной интеллектуальной работы.
Разрушая границы соотношения цены и производительности
Самой поразительной особенностью Claude Opus 5 является агрессивная структура ценообразования. В то время как топовая Claude Fable 5 стоит 10 долларов за миллион входных токенов и 50 долларов за миллион выходных токенов, Opus 5 сокращает эти тарифы вдвое: 5 долларов за миллион входных и 25 долларов за миллион выходных токенов.
Чтобы удовлетворить требования к задержке (latency), Anthropic также представила «Fast Mode», который увеличивает скорость обработки в 2,5 раза, хотя это и приводит к удвоению стоимости токенов. Такое многоуровневое ценообразование в сочетании с огромным контекстным окном в 1 миллион токенов делает Opus 5 новой моделью по умолчанию для Claude Max и самым мощным вариантом для пользователей Claude Pro.
Превосходство в бенчмарках: кодинг и рассуждения
Opus 5 — это не просто бюджетная альтернатива, а настоящий лидер производительности в определенных областях. В агентном терминальном кодинге (agentic terminal coding) по тесту Frontier-Bench v0.1 модель Opus 5 достигла показателя 43,3%, значительно опередив как Fable 5 (33,7%), так и GPT-5.6 Sol (34,4%). Она также продемонстрировала доминирование в интеллектуальной работе, возглавив бенчмарк GDPval-AA v2 с рейтингом Elo 1861.
Пожалуй, самая ошеломляющая статистика получена в бенчмарке ARC-AGI-3, который измеряет способность к решению принципиально новых задач. Opus 5 набрала 30,2%, что почти в четыре раза превышает результат GPT-5.6 Sol (7,8%). Это свидетельствует о колоссальном скачке в способности модели справляться с задачами, выходящими за рамки паттернов её обучающих данных.
Интеллектуальное масштабирование усилий и эффективность
Anthropic представила сложную систему «усилий» (effort), позволяющую пользователям переключаться между пятью настройками: low, medium, high, xhigh и max. Это обеспечивает возможность тонкой настройки баланса между потреблением токенов и глубиной рассуждений.
Хотя Anthropic рекомендует использовать настройки «low» и «medium» для общих задач с целью оптимизации затрат, для сложного агентного кодинга они советуют использовать «xhigh». Интересно, что компания отметила снижение эффективности на настройке «max»: как в Frontier-Bench v0.1, так и в Artificial Analysis Coding Agent Index, производительность Opus 5 на максимальных усилиях фактически немного снизилась, несмотря на более высокую стоимость. Это говорит о том, что настройка «xhigh» на данный момент является оптимальным вариантом (sweet spot) с точки зрения эффективности.
Улучшенная безопасность и автономность
В качестве прямого ответа на отзывы пользователей Anthropic доработала классификаторы безопасности для Opus 5. Киберфильтры модели срабатывают примерно на 85% реже, чем в Fable 5, что решает проблему предыдущих жалоб на чрезмерную блокировку легитимных исследований. Хотя модель по-прежнему предотвращает генерацию эксплойтов и сканирование на основе бинарных файлов, она стала гораздо более гибкой в вопросах исследования уязвимостей исходного кода.
Кроме того, Opus 5 демонстрирует улучшенные способности к самокоррекции. В ходе реального тестирования модель успешно создала 3D-модель в FreeCAD, написав собственный конвейер компьютерного зрения для интерпретации геометрии — задача, с которой не справились все остальные конкурирующие модели.
Основные выводы
- Радикальное снижение стоимости: Opus 5 предлагает производительность флагманского уровня при стоимости токенов на 50% ниже, чем у Claude Fable 5.
- Прорыв в рассуждениях: Модель показала колоссальное 4-кратное преимущество над конкурентами в бенчмарке ARC-AGI-3 по решению принципиально новых задач.
- Оптимизированный рабочий процесс разработчика: Благодаря улучшенным классификаторам безопасности и специализированным настройкам «усилий», Opus 5 обеспечивает более плавную работу при агентном кодинге и исследованиях.
