Le bug de fuite de prompts d'Anthropic a exposé une semaine de données utilisateur.

Pourquoi cette faille est importante

L'interface du modèle d'Anthropic permet aux développeurs d'envoyer des « prompts » — le texte qui oriente la réponse d'un modèle de langage. Lors de cet incident, une faille de stockage a permis à des tiers non autorisés de lire ces prompts pendant sept jours. La fuite n'était pas le résultat d'un piratage massif ; une simple négligence dans la manière dont les prompts étaient sauvegardés et récupérés a ouvert la porte.

Ce qui s'est mal passé

Séparer les données utilisateur des poids du modèle limite l'exposition. La mise en place de pistes d'audit permet de détecter précocement toute activité inhabituelle.

Actions immédiates pour les startups de l'IA

  • Sécuriser la gestion des prompts – Traitez chaque prompt entrant comme une donnée sensible. Chiffrez-les au repos, limitez les droits de lecture/écriture au plus petit ensemble de services possible, et assurez-vous que seul le moteur d'exécution du modèle peut les récupérer.
  • Séparer les données utilisateur des poids du modèle – Stockez les prompts dans un référentiel dédié, physiquement et logiquement distinct des fichiers du modèle. Cette séparation permet de limiter le périmètre d'impact de toute faille individuelle.
  • Créer des pistes d'audit – Journalisez chaque accès au stockage des prompts avec l'horodatage, l'ID de l'utilisateur et l'IP source. Exécutez des analyses en temps réel qui déclenchent des alertes en cas de volumes de lecture anormaux ou d'accès provenant de services inattendus.

Ce qu'il faut surveiller ensuite

L'essentiel : Une seule faille dans la gestion des prompts peut entraîner une exposition des données pendant une semaine entière. Les fondateurs de startups d'IA doivent appliquer la même rigueur au stockage des prompts qu'à n'importe quel autre système de données utilisateur, sous peine de répéter l'erreur coûteuse d'Anthropic.