Системный промпт Claude, работающий в основе чат-бота Anthropic, состоит из 56 148 слов — это более чем в 13 раз больше, чем версия из 4 269 слов, которую компания опубликовала публично. Такой разрыв означает, что разработчики, изучающие официальный промпт, видят лишь краткое изложение, в то время как работающая модель следует гораздо более подробному набору инструкций.
Почему размер имеет значение
Каждый ИИ-продукт считывает «системный промпт» перед тем, как обработать запрос пользователя. Промпт сообщает модели, кем она является, каким должен быть её тон, что она должна отклонять и как форматировать свои ответы. Компании обычно держат такие промпты в секрете, так как они содержат операционные детали и политики безопасности. Anthropic выпустила сокращенную версию промпта Claude для обеспечения прозрачности, но исследователь, попросивший модель повторить свои инструкции, извлек версию, которая на порядок больше.
Что раскрывают скрытые правила
- Тон проработан на уровне проектирования — обширные разделы диктуют длину предложений, предостерегают от нравоучений и предписывают определенный стиль общения. Стремление Anthropic сформировать тон показывает, что компания хочет, чтобы Claude звучал одинаково в каждом взаимодействии, а не просто выполнял функциональные команды.
- Категории отказов четко определены — в публичных политиках безопасности используются общие формулировки, но полный промпт содержит список конкретных тем, которые Claude должен отклонять, что дает более четкое представление о защитных механизмах модели.
- Правила форматирования детализированы — полученный промпт подробно описывает, как должны быть структурированы ответы: от использования маркированных списков до соглашений разметки. Разработчики могут копировать эти правила, чтобы сделать ответы своих ИИ-моделей более читабельными.
Ставки для разработчиков и исследователей
Исследователь получил более длинный промпт, попросив Claude повторить собственные инструкции. Модели могут перефразировать, пропускать или менять разделы местами, поэтому полученный текст может не быть дословной копией. Рассматривайте более длинную версию как высококачественное доказательство, а не как окончательную спецификацию.
За чем следить дальше
- Анализ сообщества — инструменты сравнения текста (text-diff) могут подсветить точные различия между двумя версиями, позволяя разработчикам извлекать полезные правила, не изобретая велосипед.
Вывод прост: публичный промпт Claude — это лишь скелет, в то время как рабочий промпт — это полноценное руководство. Любому, кто строит решения на базе Claude — или любой другой ИИ-модели, полагающейся на системные промпты, — необходимо смотреть глубже официального документа, чтобы понять истинные ограничения и возможности, определяющие поведение модели.
