Баг із витоком промптів у Anthropic призвів до витоку даних користувачів за цілий тиждень.
Чому цей витік є важливим
Інтерфейс моделі Anthropic дозволяє розробникам надсилати «промпти» — текст, який спрямовує відповідь мовної моделі. Під час інциденту помилка у системі зберігання дозволила стороннім особам читати ці промпти протягом семи днів. Витік не був результатом масштабного хакерського нападу; двері відкрила незначна помилка в тому, як промпти зберігалися та отримувалися.
Що пішло не так
Розділення даних користувачів і ваг моделі обмежує ризики витоку. Створення журналів аудиту дозволяє на ранніх етапах виявляти підозрілу активність.
Негайні дії для AI-стартапів
- Посильте захист обробки промптів – Ставтеся до кожного вхідного промпту як до конфіденційних даних. Шифруйте їх під час зберігання, обмежуйте права на читання/запис мінімально необхідним набором сервісів і переконайтеся, що отримувати їх може лише механізм виконання моделі.
- Відокремте дані користувачів від ваг моделі – Зберігайте промпти в окремому сховищі, яке фізично та логічно відрізняється від файлів моделі. Таке розділення обмежує масштаб наслідків будь-якого окремого витоку.
- Створіть журнали аудиту – Фіксуйте кожен доступ до сховища промптів із часовими мітками, ID користувачів та IP-адресами джерел. Налаштуйте аналітику в реальному часі, яка надсилатиме сповіщення про аномальні обсяги читання або доступ із неочікуваних сервісів.
На що звернути увагу далі
Підсумок: Одна лише помилка в обробці промптів може призвести до каскадного витоку даних протягом тижня. Засновники AI-проєктів мають застосовувати таку ж суворість до зберігання промптів, як і до будь-якої іншої системи даних користувачів, інакше вони повторять дорогу помилку Anthropic.
