Une vulnérabilité de confidentialité est apparue avec le Claude d'Anthropic : des conversations privées et des « Artifacts » sont devenus consultables via Google. L'incident oppose le partage initié par l'utilisateur à l'indexation du Web à l'ère de l'IA.

Le mécanisme de l'exposition

Des utilisateurs de Reddit ont découvert la faille en utilisant des opérateurs Google tels que site:claude.ai/share, contournant ainsi la confidentialité prévue par la fonctionnalité « share chat ». Claude avertit que « toute personne disposant du lien peut le consulter », mais cette fonctionnalité est destinée à un partage ciblé et non à une visibilité mondiale.

Contrairement à Google Docs, qui bloque les robots d'indexation par défaut, les URL partagées de Claude ont été indexées par Google, permettant à n'importe qui de tomber sur des informations sensibles via des recherches ordinaires.

Données sensibles et contenus à risque

Des médias tels que Futurism et TechCrunch ont rapporté que les résultats indexés contenaient :

  • Informations personnelles identifiables (PII) : noms et numéros de téléphone d'enfants d'âge primaire.
  • Dossiers médicaux : résultats détaillés d'essais cliniques et rapports de patients réels.
  • Intelligence d'entreprise : documents marqués « usage interne uniquement » et évaluations de performance des employés.
  • Actifs techniques : extraits de code et notes de travail issus de la fonctionnalité « Artifacts » de Claude.

Certains chats exposés ont également échappé aux filtres de sécurité d'Anthropic, affichant du contenu sexuellement explicite et soulevant d'autres préoccupations en matière de modération.

Réactions d'Anthropic et de Google

Anthropic a défendu son architecture, affirmant qu'elle ne partage pas les répertoires de chat ou les sitemaps avec les moteurs de recherche. La porte-parole Amie Rotherham a expliqué que les liens de partage n'apparaissent dans les résultats de recherche qu'après que les utilisateurs les ont publiés sur des plateformes externes exploitables par les robots, et que les URL ne sont « pas devinables ». Une fois qu'un lien est « dans la nature », il peut être archivé par des tiers.

Le porte-parole de Google, Ned Adriance, a fait écho en précisant que les moteurs de recherche indexent tout ce qu'ils peuvent trouver, à moins que les propriétaires de sites ne bloquent explicitement l'exploration. Des tests suggèrent que l'exposition a été supprimée de l'index de Google, mais un incident similaire l'année dernière avait également indexé des centaines de chats Claude.

Pourquoi cela importe pour les utilisateurs d'IA

Les développeurs et les fondateurs intégrant des LLM doivent traiter les « liens partagés » comme étant publics et non sécurisés. À mesure que les outils d'IA passent du statut d'assistants personnels à celui de collaborateurs d'entreprise, la frontière entre le contenu web public et les données privées nécessite une application technique, et pas seulement un avertissement via une info-bulle.

Points clés à retenir

  • Auditez vos paramètres : Allez dans Settings → Privacy → Shared Chats dans Claude et révoquez tous les liens publics actifs.
  • Considérez les liens de partage comme publics : Partez du principe que tout lien généré par l'IA peut être indexé par les moteurs de recherche.
  • Prudence en entreprise : Appliquez des politiques strictes concernant les fonctionnalités de « partage » pour éviter les fuites accidentelles de code propriétaire ou de PII sensibles.

La plateforme d'IA Claude d'Anthropic a par inadvertance exposé des chats privés et des « Artifacts » après que Google a indexé ses URL de liens de partage, rendant des conversations sensibles consultables. Des utilisateurs de Reddit ont repéré la fuite grâce à une requête Google spécifique au site, exposant des données personnelles, médicales et d'entreprise.

Comment l'exposition s'est produite

La fonctionnalité « share chat » de Claude génère une URL que l'interface avertit de pouvoir être consultée par toute personne en sa possession. L'intention est de transmettre le lien à un collègue, pas de le diffuser largement. Comme les URL se trouvent sous le domaine claude.ai/share, le fait de publier le lien sur n'importe quel site public exploitable par les robots — forums, réseaux sociaux ou commentaire Reddit — permet au robot de Google de le suivre.

Les utilisateurs de Reddit ont découvert le problème en recherchant site:claude.ai/share sur Google, ce qui a renvoyé des conversations censées rester privées. Contrairement à Google Docs, dont les liens partagés sont protégés de l'indexation par défaut, les liens de Claude manquaient de cette protection, permettant au moteur de recherche de les répertorier.

Ce qui a été exposé

Plusieurs médias ont rapporté que les résultats indexés contenaient :

  • Informations personnelles identifiables (PII) : noms et numéros de téléphone d'enfants d'âge primaire.
  • Dossiers médicaux : données détaillées d'essais cliniques et rapports de patients réels.
  • Intelligence d'entreprise : documents marqués « usage interne uniquement », évaluations de performance des employés et autres informations propriétaires.
  • Actifs techniques : extraits de code, notes de travail et autres artefacts générés via la fonctionnalité « Artifacts » de Claude.

Dans quelques cas, des chats visibles publiquement comprenaient également du contenu ayant échappé aux filtres de sécurité d'Anthropic, produisant du matériel sexuellement explicite.

Réponse d'Anthropic

Anthropic soutient qu'elle ne publie pas de répertoires de chat ni de sitemaps pour les moteurs de recherche. Un porte-parole de l'entreprise a expliqué que les liens partagés n'apparaissent dans les résultats de recherche qu'après qu'un utilisateur a publié l'URL sur une plateforme externe et indexable, et a souligné que les URL ne sont « pas devinables ». Une fois qu'un lien est délibérément partagé en ligne, l'entreprise ne peut pas contrôler l'archivage par des tiers.

La position de Google

Google a réitéré qu'il ne décide pas de ce qui est public ; il indexe ce qu'il peut trouver, à moins qu'un site ne bloque explicitement l'exploration. L'entreprise a déclaré qu'elle respectait les directives telles que robots.txt ou les balises meta demandant l'exclusion. Des tests préliminaires effectués après l'incident suggèrent que les URL exposées ont été supprimées de l'index de Google, bien que Google n'ait pas confirmé de solution permanente.

Pourquoi cela importe pour les utilisateurs d'IA

Cet épisode met en lumière un risque plus large à mesure que les grands modèles de langage passent du statut d'assistants personnels à celui d'outils intégrés aux flux de travail en entreprise. Un « lien partageable » est un mécanisme de commodité que n'importe quel robot d'exploration peut collecter. Pour les organisations manipulant des données réglementées — dossiers de santé, évaluations d'employés, code propriétaire — supposer qu'un lien est sûr sous prétexte qu'il est « seulement partagé » peut entraîner des fuites coûteuses.

Contre-argument : Les limites de la plateforme

Anthropic soutient que la responsabilité incombe aux utilisateurs qui publient le lien. La plateforme avertit que toute personne disposant de l'URL peut consulter le contenu et qu'elle n'expose pas les URL dans un répertoire public. Google réplique qu'il ne peut pas surveiller chaque lien privé qui fait surface ; son rôle est de respecter les demandes des propriétaires de sites de ne pas apparaître dans les résultats de recherche.

Les deux positions sont techniquement exactes, pourtant elles laissent un vide : l'expérience utilisateur ne rend pas le risque d'indexation évident, et la plateforme n'applique pas automatiquement de directives « no-index » aux pages partagées. La responsabilité de prévenir l'exposition publique accidentelle incombe donc aux utilisateurs, qui pourraient ne pas réaliser avec quelle facilité un lien peut être découvert via une simple requête de recherche.

À surveiller ensuite

Étapes pratiques pour les utilisateurs

  • Auditer les liens actifs : Ouvrez les paramètres de Claude, accédez à la section confidentialité pour les chats partagés, et révoquez toutes les URL dont vous n'avez plus besoin.
  • Considérer chaque lien de partage comme public : Partez du principe qu'une fois qu'un lien est publié quelque part en ligne, il peut être indexé, sauf s'il est explicitement bloqué.
  • Contrôles d'entreprise : Déployez des outils de surveillance qui signalent la création de liens de partage contenant des mots-clés tels que « PII », « confidentiel » ou « interne », et imposez des flux d'approbation avant que ces liens ne quittent le réseau de l'entreprise.

L'incident Claude nous rappelle que la commodité du partage instantané peut devenir un risque lorsque le web traite ces liens comme des pages ordinaires. Tant que les plateformes ne protégeront pas automatiquement les URL partagées, les utilisateurs devront rester vigilants.