Anthropic tiene previsto dotar a los futuros modelos Claude de un mecanismo de marca de agua para textos, que permitirá a quien posea la clave adecuada estimar la probabilidad de que Claude haya participado en la creación del texto. La empresa explicó en una publicación fechada el 14 de agosto de 2026 que la marca no será visible para los lectores, no añadirá caracteres ocultos ni datos identificativos, y tampoco requerirá tokens adicionales ni elevará el coste de funcionamiento del modelo.
La medida se enmarca en el cumplimiento por parte de Anthropic de la Ley de Inteligencia Artificial de la Unión Europea. En julio de 2026, la empresa, junto con otros importantes proveedores de modelos y aproximadamente 190 entidades firmantes en total, suscribió el código europeo de prácticas sobre transparencia en los contenidos generados mediante inteligencia artificial. Según Anthropic, desde el 2 de agosto la Unión Europea exige a los proveedores de inteligencia artificial que prestan servicios en su mercado etiquetar los contenidos generados automáticamente.
¿Cómo funciona la marca de agua?
Los modelos de lenguaje generan texto palabra por palabra y, en cada paso, eligen entre varias palabras posibles. Cuando existen varias opciones similares en significado y calidad, la marca de agua utiliza una clave y un conjunto de palabras anteriores para determinar la fuente de aleatoriedad que resuelve la elección. De este modo, la elección sigue siendo prácticamente aleatoria, pero la secuencia de palabras deja un patrón que puede detectarse posteriormente mediante la clave.
Anthropic afirma que este mecanismo no impulsa a Claude a elegir palabras que normalmente no utilizaría ni lo hace inclinarse siempre por una palabra concreta. La empresa compara el proceso con utilizar una secuencia de números procedente del valor de pi en lugar de lanzar un dado: el resultado parece aleatorio, pero el análisis de la serie de resultados puede revelar la fuente de aleatoriedad.
Ningún efecto práctico sobre la calidad del texto
Según pruebas internas, Anthropic no observó ningún efecto en el contenido, la creatividad o la legibilidad de los textos de Claude. También señala un estudio de SynthID-Text que probó la técnica en una parte del tráfico de Gemini y no encontró diferencias estadísticamente significativas entre las evaluaciones de textos marcados y no marcados. En un estudio controlado, los evaluadores humanos no pudieron percibir diferencias de calidad al comparar las respuestas lado a lado.
La empresa confirma que la marca solo ralentiza los modelos mínimamente y no encarece el servicio, ya que no produce tokens adicionales. Tampoco contiene información que pueda revelar la identidad del usuario o de su organización, ni sus conversaciones.
Limitaciones de la detección y casos de edición y programación
La eficacia de la detección depende de la longitud del texto y del número de decisiones en las que el modelo dispone de más de una opción adecuada. Por ello, la detección es más débil en muestras cortas y en fragmentos fácticos que solo permiten una respuesta precisa, como mencionar el nombre correcto de una obra de Isaac Newton. Lo mismo ocurre con la corrección lingüística ligera, ya que la mayoría de las palabras siguen siendo obra del usuario y la marca de agua no encuentra suficiente material sobre el que apoyarse.
En programación, la marca normalmente no se aplica cuando es necesaria una salida exacta, porque cambiar una palabra o un símbolo podría romper el código. Sin embargo, puede aparecer en partes con opciones arbitrarias, como los comentarios del código, con un efecto mínimo en el código propiamente dicho. En cambio, las traducciones generadas por Claude llevan la marca porque el modelo elige todas sus palabras.
Disponibilidad y qué demuestra la marca
Anthropic está trabajando para ofrecer una interfaz de programación de aplicaciones para detectar la marca de agua, pero todavía no ha definido los detalles de su implementación. La marca se aplicará en todo el mundo cuando se lance, ya que actualmente no dispone de una forma sostenible de limitarla por región. La empresa también trabaja para añadirla a los modelos Claude lanzados antes del 2 de agosto de 2026, aprovechando el periodo de transición previsto por la legislación europea, con la intención de hacerlo durante los próximos meses.
La marca no demuestra que Claude haya escrito todo el texto; solo determina la probabilidad de que haya participado en su producción o procesamiento, y no distingue entre la redacción original y la edición intensiva. Reescribir completamente el texto puede eliminar la marca, mientras que una edición ligera puede no eliminarla. La marca no modifica los derechos del usuario, la propiedad del contenido ni la responsabilidad legal sobre este.
En el caso de los archivos compatibles, como PNG, JPG y SVG, Claude añadirá credenciales de contenido en forma de una nota firmada criptográficamente dentro de los metadatos del archivo, conforme al estándar abierto C2PA. Anthropic afirma que estos datos no modifican el archivo ni incluyen información identificativa, y que las herramientas compatibles con C2PA pueden leerlos.