Anthropic intégrera une signature numérique cachée dans chaque texte et fichier produit par ses modèles Claude, une initiative conçue pour satisfaire aux nouvelles règles de transparence de l'Union européenne en matière d'IA. Ce changement prend effet pour tous les modèles publiés après l'entrée en vigueur du Code de transparence de l'IA de l'UE le 2 août, et il apparaîtra automatiquement sur les interfaces API, Code, Cowork et Tag de Claude.

Pourquoi la règle de l'UE est importante

Le Code de transparence oblige les développeurs à marquer le contenu généré ou édité par l'IA afin que les systèmes en aval puissent identifier son origine synthétique. La règle vise à freiner la désinformation et à donner aux utilisateurs un signal clair lorsqu'ils sont confrontés à un contenu conçu par une machine. La réponse d'Anthropic — le tatouage numérique au niveau du modèle — place le marqueur directement dans le résultat plutôt que de l'ajouter via l'interface utilisateur d'un produit.

D'autres géants de l'IA font des promesses similaires. Google, Meta, Microsoft, OpenAI et Black Forest Labs ont tous déclaré qu'ils respecteraient les normes de l'UE. Pour les contenus non textuels, Anthropic utilisera la norme ouverte C2PA, une méthode documentée publiquement pour intégrer des données de provenance dans les images, les vidéos et d'autres médias. En suivant une spécification ouverte, Anthropic espère que ses marquages fonctionneront avec les outils déjà utilisés par les journalistes, les plateformes et les vérificateurs de faits.

Comment fonctionne le tatouage numérique

Anthropic affirme que le tatouage numérique est intégré au processus de génération de texte du modèle. En pratique, la signature fait partie du flux de jetons émis par le modèle. Lorsqu'un utilisateur copie le texte dans un traitement de texte, un e-mail ou une publication sur les réseaux sociaux, le motif caché l'accompagne. L'entreprise note que le tatouage peut survivre à des modifications mineures, mais elle n'a pas précisé combien de caractères doivent être modifiés avant que la marque ne disparaisse.

La préoccupation du « Claudefishing »

Le déploiement d'Anthropic intervient alors que l'inquiétude grandit face à l'utilisation abusive des grands modèles de langage (LLM). Le PDG de Substack, Chris Best, a récemment inventé le terme « Claudefishing » pour décrire l'utilisation de l'IA afin de créer du contenu trompeur qui imite la voix d'un auteur particulier. À mesure que le texte synthétique devient plus difficile à distinguer de l'écriture humaine, la détection automatisée de la provenance devient une ligne de défense cruciale.

Anthropic n'est pas la seule à ajouter des garde-fous. La plateforme de génération musicale Suno et le service de newsletter Substack ont introduit des mécanismes de signalement qui alertent les lecteurs lorsqu'un contenu a été créé par l'IA. En intégrant le tatouage numérique à la source, Anthropic vise à rendre le signal plus difficile à supprimer et plus facile à traiter pour les filtres en aval.

Points clés à retenir

  • Conformité réglementaire : Anthropic met en œuvre le tatouage numérique pour répondre au Code de transparence de l'IA de l'UE, entré en vigueur le 2 août.
  • Intégration au niveau du modèle : Les tatouages numériques sont appliqués au niveau du modèle, ils persistent donc dans tous les produits (API, Claude Code, etc.) et survivent aux actions de copier-coller.
  • Marquage standardisé des fichiers : Pour les fichiers, Anthropic utilisera la norme ouverte C2PA afin de garantir l'interopérabilité et la transparence du contenu numérique.