A Anthropic irá incorporar uma assinatura digital oculta em cada texto e arquivo produzido por seus modelos Claude, uma medida projetada para satisfazer as novas regras de transparência de IA da União Europeia. A mudança entra em vigor para todos os modelos lançados após a entrada em vigor do Código de Transparência da Lei de IA da UE, em 2 de agosto, e aparecerá automaticamente nas interfaces API, Code, Cowork e Tag do Claude.
Por que a regra da UE é importante
O Código de Transparência obriga os desenvolvedores a marcar conteúdos gerados ou editados por IA para que sistemas subsequentes possam identificar sua origem sintética. A regra visa conter a desinformação e dar aos usuários um sinal claro quando estiverem lidando com material criado por máquinas. A resposta da Anthropic — a marca d'água em nível de modelo — insere o marcador diretamente na saída, em vez de apenas anexá-lo à interface de usuário de um produto.
Outros gigantes da IA estão fazendo promessas semelhantes. Google, Meta, Microsoft, OpenAI e Black Forest Labs afirmaram que cumprirão os padrões da UE. Para ativos que não sejam texto, a Anthropic usará o padrão aberto C2PA, um método publicamente documentado para incorporar dados de procedência em imagens, vídeos e outras mídias. Ao seguir uma especificação aberta, a Anthropic espera que suas marcações funcionem com ferramentas que jornalistas, plataformas e verificadores de fatos já utilizam.
Como a marca d'água funciona
A Anthropic afirma que a marca d'água é integrada ao processo de geração de texto do modelo. Na prática, a assinatura torna-se parte do fluxo de tokens que o modelo emite. Quando um usuário copia o texto para um processador de texto, um e-mail ou uma postagem em rede social, o padrão oculto o acompanha. A empresa observa que a marca d'água pode sobreviver a edições modestas, mas não revelou quantos caracteres precisam ser alterados antes que a marca desapareça.
A preocupação com o “Claudefishing”
O lançamento da Anthropic ocorre em um momento de crescente preocupação com o uso indevido de grandes modelos de linguagem (LLMs). O CEO da Substack, Chris Best, cunhou recentemente o termo “Claudefishing” para descrever o uso de IA para criar conteúdo enganoso que imita a voz de um autor específico. À medida que o texto sintético se torna mais difícil de distinguir da escrita humana, a detecção automatizada de procedência torna-se uma linha de defesa crucial.
A Anthropic não é a única a adicionar salvaguardas. A plataforma de geração de música Suno e o serviço de newsletter Substack introduziram mecanismos de sinalização que alertam os leitores quando uma peça foi criada por IA. Ao incorporar a marca d'água na fonte, a Anthropic visa tornar o sinal mais difícil de remover e mais fácil de ser processado por filtros subsequentes.
Principais Conclusões
- Conformidade Regulatória: A Anthropic está implementando a marca d'água para cumprir o Código de Transparência da Lei de IA da UE, que entrou em vigor em 2 de agosto.
- Integração em Nível de Modelo: As marcas d'água são aplicadas no nível do modelo, portanto, persistem em todos os produtos (API, Claude Code, etc.) e sobrevivem a ações de copiar e colar.
- Marcação de Arquivos Padronizada: Para arquivos, a Anthropic usará o padrão aberto C2PA para garantir a interoperabilidade e a transparência no conteúdo digital.
