Anthropic официально представила долгожданные модели Claude Fable 5.1 и Mythos 5.1, ориентированные на растущий спрос на эффективных и высокопроизводительных ИИ-агентов. Это обновление направлено на снижение операционных расходов, совершенствование механизмов безопасности и расширение возможностей рассуждения для сложных многоэтапных рабочих процессов.

Радикальное снижение стоимости агентских рабочих процессов

Одним из наиболее значимых изменений в этом релизе является агрессивная новая структура ценообразования, разработанная для «агентских» задач — рабочих процессов, в которых ИИ должен выполнить несколько итеративных шагов для достижения цели. Anthropic утверждает, что Claude Fable 5.1 обычно на 25% дешевле своего предшественника, Fable 5, но может обеспечить экономию до 45% при выполнении сложных агентских операций.

Столь значительное снижение достигается за счет оптимизированной стоимости кэшированных данных. Снижая цену на данные, которые уже были обработаны и сохранены, Anthropic делает экономически выгодным создание для разработчиков долгоживущих и ресурсоемких ИИ-агентов, полагающихся на многократное извлечение контекста.

Превосходные возможности программирования и рассуждения

Первые пользователи из индустрии уже сообщают о значительных скачках производительности. Дэн Шиппер, генеральный директор Every, назвал Fable 5.1 самой мощной моделью для написания кода из доступных на данный момент, отметив, что модель не только работает быстрее и эффективнее расходует токены, но и обладает более естественным, человечным тоном общения.

Улучшения выходят за рамки простого создания текста и охватывают нюансированную интерпретацию данных. Генеральный директор Box Аарон Леви отметил, что агенты его компании, использующие Fable 5.1, смогли обнаружить тонкости и неоднозначности в наборах данных, которые предыдущая модель Fable 5 полностью упускала. Кроме того, модель Mythos 5.1 продемонстрировала поразительную эффективность: данные бенчмарков показывают, что Mythos 5.1 в режиме «low reasoning» работает на уровне настроек «Max reasoning» предыдущего поколения, что представляет собой колоссальный скачок в архитектурной эффективности.

Усовершенствованные меры защиты и конфиденциальность корпоративных данных

Anthropic также работает над устранением давней критики в адрес «чрезмерно рьяных» фильтров безопасности. Fable 5.1 оснащена более точными механизмами защиты, что снижает вероятность ложноположительных срабатываний на безобидные запросы, такие как базовые вопросы по биологии. Хотя Mythos 5.1 сохраняет более строгие биологические ограничения, общая цель заключается в создании пользовательского опыта, ориентированного на практическую пользу.

Став важным достижением для корпоративной безопасности, Anthropic анонсировала функцию «Enterprise Frontier Safeguards». Эта функция, внедрение которой начнется поздней осенью, обеспечит «полную конфиденциальность», позволяя клиентам хранить данные на собственных облачных серверах, а не на инфраструктуре Anthropic. Кроме того, хотя Fable 5.1 теперь разрешено использовать для выявления уязвимостей в программном обеспечении, Anthropic сохраняет строгие границы, перенаправляя высокорискованные задачи — такие как генерация эксплойтов и тестирование на проникновение — на свои более мощные модели Opus.

Основные выводы

  • Экономическая эффективность: Claude Fable 5.1 обеспечивает снижение затрат на агентские задачи до 45% благодаря оптимизированной стоимости кэшированных данных.
  • Прирост производительности: Первые отзывы подчеркивают превосходные способности к программированию, лучшее распознавание неоднозначностей в данных и повышенную эффективность рассуждений.
  • Повышенная конфиденциальность: Новые функции Enterprise Frontier Safeguards позволят компаниям хранить данные на собственных облачных серверах для обеспечения полной приватности.