Anthropic incorporará una firma digital oculta en cada texto y archivo producido por sus modelos Claude, una medida diseñada para cumplir con las nuevas normas de transparencia de la Unión Europea en materia de IA. El cambio entra en vigor para todos los modelos lanzados después de que el Código de Transparencia de la Ley de IA de la UE entrara en vigor el 2 de agosto, y aparecerá automáticamente en las interfaces API, Code, Cowork y Tag de Claude.
Por qué es importante la norma de la UE
El Código de Transparencia obliga a los desarrolladores a marcar el contenido generado o editado por IA para que los sistemas posteriores puedan detectar su origen sintético. La norma tiene como objetivo frenar la desinformación y ofrecer a los usuarios una señal clara cuando están tratando con material elaborado por máquinas. La respuesta de Anthropic —el marcado de agua a nivel de modelo— coloca la marca directamente en el resultado en lugar de añadirla en la interfaz de usuario de un producto.
Otros gigantes de la IA están haciendo promesas similares. Google, Meta, Microsoft, OpenAI y Black Forest Labs han afirmado que cumplirán con los estándares de la UE. Para los activos que no sean texto, Anthropic utilizará el estándar abierto C2PA, un método documentado públicamente para incrustar datos de procedencia en imágenes, vídeos y otros medios. Al seguir una especificación abierta, Anthropic espera que sus marcas funcionen con las herramientas que periodistas, plataformas y verificadores de datos ya utilizan.
Cómo funciona la marca de agua
Anthropic afirma que la marca de agua está integrada en el proceso de generación de texto del modelo. En la práctica, la firma pasa a formar parte del flujo de tokens que emite el modelo. Cuando un usuario copia el texto en un procesador de textos, un correo electrónico o una publicación en redes sociales, el patrón oculto viaja con él. La empresa señala que la marca de agua puede sobrevivir a ediciones moderadas, pero no ha revelado cuántos caracteres deben cambiar antes de que la marca desaparezca.
La preocupación por el “Claudefishing”
El despliegue de Anthropic llega en un momento de creciente alarma por el uso indebido de los modelos de lenguaje de gran tamaño (LLM). El CEO de Substack, Chris Best, acuñó recientemente el término “Claudefishing” para describir el uso de la IA para crear contenido engañoso que imita la voz de un autor en particular. A medida que el texto sintético es cada vez más difícil de distinguir de la escritura humana, la detección automatizada de la procedencia se convierte en una línea de defensa crucial.
Anthropic no es la única en añadir salvaguardas. La plataforma de generación de música Suno y el servicio de boletines Substack han introducido mecanismos de señalización que alertan a los lectores cuando una pieza ha sido creada por IA. Al incrustar la marca de agua en la fuente, Anthropic pretende que la señal sea más difícil de eliminar y más fácil de procesar para los filtros posteriores.
Conclusiones clave
- Cumplimiento normativo: Anthropic está implementando el marcado de agua para cumplir con el Código de Transparencia de la Ley de IA de la UE, que entró en vigor el 2 de agosto.
- Integración a nivel de modelo: Las marcas de agua se aplican a nivel de modelo, por lo que persisten en todos los productos (API, Claude Code, etc.) y sobreviven a las acciones de copiar y pegar.
- Marcado de archivos estandarizado: Para los archivos, Anthropic utilizará el estándar abierto C2PA para garantizar la interoperabilidad y la transparencia en el contenido digital.
