Juanma Aranda

REGULACION

Anthropic detalla la marca de agua invisible en los textos de Claude y la despliega globalmente para ajustarse a la UE

Anthropic ha explicado cómo funciona su nueva marca de agua para los textos de Claude: se codifica durante la generación, no usa metadatos, sobrevive al copiar y pegar y solo puede detectarse con una clave criptográfica. Llega tras las exigencias de la UE y se desplegará globalmente. Habrá API de detección y tiene limitaciones importantes.

Audio con ElevenLabs

Qué ha ocurrido

Anthropic ha aclarado el funcionamiento de su marca de agua para textos de Claude: no inserta metadatos ni caracteres ocultos, sino que se codifica en el propio proceso de generación, de modo que únicamente es detectable por quien posee la clave criptográfica. Según la compañía, no añade tokens, coste ni latencia, persiste al copiar y pegar, y no identifica al usuario, la organización ni la conversación. La medida se activa tras las nuevas obligaciones de marcado en la UE desde el 2 de agosto y se aplicará globalmente. Es una implementación del método SynthID-Text de Google DeepMind y apunta a estimar la probabilidad de intervención de Claude, no a probar autoría. Anthropic avanza que publicará una API de detección.

Qué significa para creadores

Si trabajas con Claude en España, tus textos saldrán “firmados” de forma invisible sin afectar a calidad ni creatividad, según Anthropic. El sello puede indicar probabilidad de intervención de la IA a quien tenga la clave o acceso a la futura API, pero no demuestra autoría ni propiedad, y es menos robusto en textos muy cortos, muy factuales o en código; una reescritura profunda puede eliminarlo. En la práctica, ayuda a alinearte con el marcado exigido por la UE, pero no sustituye informar con claridad a clientes y audiencias cuando uses IA. Conserva borradores y notas de proceso si necesitas justificar cómo has usado la herramienta, y evita confiar en este método para disputas de atribución.

Fuente y contexto

Según Xataka, Anthropic implementa este sistema a raíz del Código de Prácticas sobre Transparencia de Contenido Generado por IA, firmado por más de 190 organizaciones, y del marco de la Ley de IA de la UE que exige marcado desde el 2 de agosto. La compañía subraya que la detección es probabilística y que el método, basado en SynthID-Text, no prueba autoría. Entre sus límites: menor eficacia en piezas breves o de hechos, o en código, y la posibilidad de borrado mediante reescritura extensa.