Anthropic внедрила значительное обновление для своей модели Fable 5, радикально сократив количество безобидных биологических запросов, блокируемых слоями безопасности. Эта стратегическая корректировка направлена на восстановление полезности модели для законных научных исследований при сохранении строгих мер защиты от высокорискованных биологических угроз.

Снижение барьеров для научных исследований

В ответ на критику со стороны научного сообщества Anthropic успешно сократила количество ложноположительных срабатываний в своих фильтрах биологической безопасности для Fable 5 примерно на 85 процентов. Ранее классификатор безопасности модели был излишне агрессивным, часто блокируя законные научные запросы и перенаправляя пользователей к менее способной модели Opus 5.

Это обновление позволяет исследователям и медицинским работникам в полной мере использовать возможности рассуждения Fable 5 для широкого спектра безобидных задач. Теперь пользователи могут выполнять сложные операции, такие как интерпретация результатов лабораторных исследований, анализ клинических симптомов и ответы на сложные медицинские вопросы, не сталкиваясь со «стеной безопасности», которая ранее препятствовала продуктивности.

Сохранение ограничений в отношении рисков двойного назначения

Несмотря на смягчение общих ограничений в области биологии, Anthropic придерживается жесткой позиции в отношении исследований «двойного назначения» — информации, которая может быть использована во вред. Компания не сняла ограничения на темы высокой степени чувствительности, включая вирусологию, токсикологию и передовое молекулярное проектирование.

Логика Anthropic обусловлена уникальной природой биологических угроз. В отличие от кибератаки, которую можно нейтрализовать с помощью патчей и отключения систем, выпущенный биологический агент практически невозможно «отключить» после начала его распространения. Компания привела несколько серьезных опасений, определяющих такую осторожность, в том числе:

  • Анализ разведывательных служб США относительно биологических рисков.
  • Исследования, демонстрирующие, что ИИ может быть использован для проектирования полностью синтетических вирусов.
  • Задокументированные попытки пользователей получить инструкции по созданию биооружия от существующих LLM.

Баланс между безопасностью и специализированным доступом

Задача лабораторий ИИ заключается в том, чтобы найти баланс между открытым научным прогрессом и предотвращением катастрофического злоупотребления технологиями. Anthropic пытается решить эту проблему путем разработки программ специализированного доступа. Эти программы предназначены для того, чтобы позволить верифицированным исследователям получать доступ к ограниченным функциям — таким как функции, связанные с вирусологией или молекулярным моделированием — в контролируемой и проверяемой среде.

Разделяя безобидные медицинские запросы и опасные исследования двойного назначения, Anthropic пытается создать прецедент того, как передовые модели должны работать с «биологическим рубежом», гарантируя, что инструменты современной медицины непреднамеренно не превратятся в инструменты биотерроризма.

Основные выводы

  • Снижение количества ложноположительных срабатываний на 85%: Anthropic значительно снизила барьер для законных биологических запросов, перестав принудительно переводить пользователей на менее мощную Opus 5.
  • Жесткие ограничения в высокорискованных областях: Строгие ограничения на вирусологию, токсикологию и молекулярное проектирование остаются в силе для предотвращения создания биологического оружия.
  • Контролируемый доступ для исследователей: Anthic разрабатывает специальные программы доступа, чтобы предоставить проверенным ученым необходимые им ограниченные возможности для законных исследований.

Anthropic сократила количество ложноположительных блокировок безобидных биологических запросов в своей модели Fable 5 примерно на 85 процентов, восстановив доступ к полным возможностям рассуждения модели для исследователей. Изменение сохраняет строгие меры защиты в отношении биологических тем двойного назначения, запрещая модели предоставлять инструкции, которые могли бы способствовать созданию биооружия.

Почему это обновление важно

Слой безопасности Fable 5 изначально был откалиброван с избыточной осторожностью, помечая широкий спектр законных научных вопросов как высокорискованные. Пользователи, запрашивавшие рутинную интерпретацию результатов лабораторных исследований или анализ клинических симптомов, регулярно перенаправлялись к менее способной модели Opus 5. Избыточное блокирование вызвало критику со стороны научного сообщества, которое утверждало, что подобные препятствия мешают подлинным исследованиям и замедляют принятие медицинских решений. Сократив уровень ложноположительных срабатываний примерно на четыре пятых, Anthropic стремится вернуть продвинутые возможности рассуждения модели в руки врачей, биологов и других специалистов, которым они необходимы для повседневных задач.

Как были изменены фильтры

The improvement stems from a retuned classifier that distinguishes between ordinary biomedical queries and those that touch on “dual-use” research—information that could be repurposed for harm. The new classifier still intercepts requests involving virology, toxicology, and advanced molecular design, but it lets through questions about standard diagnostics, symptom triage, and data interpretation.

Anthropic’s engineers noted that biological threats differ from cyber threats: once a pathogen is released, it cannot be patched or shut down. That reality drove the decision to keep a hard line on high-risk domains while loosening the net around routine medical inquiries.

What remains off-limits

The model continues to refuse requests that could facilitate the creation of harmful agents. Specifically, any prompt seeking:

  • detailed virology protocols that could aid virus synthesis,
  • toxicology pathways for weaponizable chemicals, or
  • step-by-step molecular engineering instructions.

Anthropic cited three sources for its caution: analyses from U.S. intelligence agencies highlighting biological risk, research showing AI can design fully synthetic viruses, and documented attempts by users to solicit bioweapon instructions from existing language models.

Access program for vetted scientists

To balance open research with security, Anthropic is rolling out a specialized access program. Verified researchers can apply for a controlled environment where the restricted capabilities are unlocked under audit. The program is designed to let legitimate scientists explore high-risk topics—such as novel vaccine platforms or pathogen modeling—without exposing the broader public to dangerous guidance.

Takeaway

By cutting 85 % of false-positive blocks while keeping strict dual-use bans, Anthropic aims to give researchers the power of its most capable model without opening the door to bioweapon design. The success of this calibrated safety strategy could set a template for how frontier AI models handle other high-stakes scientific fields.