Ciberseguridad

Las herramientas para eliminar marcas de agua de textos de inteligencia artificial se propagan sin pruebas de su eficacia

En los días posteriores al anuncio de Anthropic de que había activado marcas de agua invisibles en los textos generados por Claude, aparecieron varios proyectos de código abierto y servicios comerciales que afirman poder eludirlas. Sin embargo, actualmente no es posible verificar esas afirmaciones, ya que Anthropic no ha publicado el mecanismo de la marca ni una herramienta para detectarla.

2026-08-13
5 min de lectura
8 visitas
فريق تحرير certi.news
Las herramientas para eliminar marcas de agua de textos de inteligencia artificial se propagan sin pruebas de su eficacia

Internet ha sido testigo de la aparición de un mercado de rápido crecimiento de herramientas que afirman eliminar las marcas de agua de los textos generados por inteligencia artificial, días después de que Anthropic anunciara la activación de marcas invisibles en todo lo que escribe Claude. Este mercado incluye un proyecto de código abierto que ha superado las 4500 estrellas en GitHub, varios sitios web registrados recientemente y servicios comerciales especializados en eludir las herramientas de detección de contenido generado por inteligencia artificial.

Sin embargo, actualmente no es posible verificar las afirmaciones de estas herramientas sobre la eliminación de la marca de agua textual, porque Anthropic aún no ha publicado detalles sobre su funcionamiento ni ha lanzado una herramienta pública de detección que permita saber si el texto procesado todavía contiene la marca.

Varios proyectos y servicios

Entre los proyectos más destacados se encuentra la herramienta watermarks-remover, distribuida bajo licencia MIT y desarrollada por Guillaume Meyer, fundador de Memo. La herramienta comenzó como una habilidad personalizada para un agente de Claude y posteriormente anunció compatibilidad con Claude, Gemini y SynthID-Text, además de las superficies de prueba de procedencia de OpenAI y los modelos de pesos abiertos que utilizan marcas al estilo de Kirchenbauer.

Junto a ella existen otros repositorios, como claude-watermark-cleaner, remove-ai-watermarks y noai-watermark, además de sitios web aparecidos recientemente, entre ellos claudewatermark.com, claudewatermark.rip, gptcleanup.com y claudewatermarkremover.app. StealthGPT, un servicio que vende herramientas para eludir la detección de contenido generado por inteligencia artificial, también añadió una herramienta para eliminar la marca de Claude a sus páginas de servicios. Por su parte, Human Writes anuncia que evita Turnitin y GPTZero en artículos y tareas, y afirma eliminar la marca de Claude, aunque incluye un aviso que invita a utilizar el servicio de acuerdo con las políticas de integridad académica.

¿Qué eliminan realmente estas herramientas?

Las herramientas tratan tres tipos diferentes de datos. La eliminación de caracteres ocultos, como los caracteres de ancho cero, los elementos de control bidireccional, los caracteres Unicode especiales y los espacios que se parecen a los espacios normales, es un proceso que puede verificarse y medirse. Lo mismo se aplica a la eliminación de los metadatos C2PA, EXIF y XMP de archivos PNG, JPEG, SVG, PDF, DOCX, ODT, HTML y Markdown. Sin embargo, estos datos normalmente no sobreviven después de volver a guardar el archivo, convertir su formato o hacer una captura de pantalla.

En cambio, la propia marca de agua textual no se encuentra en caracteres ocultos, sino que está vinculada a las palabras que el modelo elige. Por ello, el método conocido para abordarla consiste en reescribir el texto en gran medida utilizando otro modelo. Meyer explica que su herramienta actualmente solo elimina los metadatos y que la eliminación de las marcas propiamente dichas podría llegar más adelante, pero no está disponible por ahora.

Algunos sitios comerciales prometen producir texto limpio e indetectable, mientras que ciertos resultados se miden frente a herramientas públicas de detección y no frente a la marca de Anthropic, para la cual no existe una herramienta pública de detección. Tras clonar los proyectos y leer el código, Pasquale Pillitteri también descubrió que una de las herramientas populares de limpieza de textos dejó sin modificar una técnica habitual para transportar datos ocultos: fue posible descifrar y recuperar la carga después de que la herramienta afirmara haber limpiado el texto.

El motivo de las marcas y los riesgos de la cadena de suministro

Anthropic afirmó que los textos emitidos por modelos lanzados el 2 de agosto de 2026 o después llevan una marca de agua imperceptible integrada en la redacción, mientras que los tipos de archivo compatibles reciben datos C2PA firmados. El etiquetado se aplica a nivel del modelo a través de la API, claude.ai, Claude Code, Claude Cowork y Claude Tag, así como mediante AWS, Google Cloud y Microsoft Foundry.

Esta medida está relacionada con el artículo 50 de la Ley de Inteligencia Artificial europea, cuya aplicación entró en vigor el 2 de agosto, con sanciones que pueden alcanzar los 15 millones de euros o el 3% de los ingresos mundiales. Anthropic explica que detectar la marca significa que el contenido fue procesado por Claude, no necesariamente que haya sido escrito íntegramente por él; la marca puede aparecer al utilizar el modelo para corrección lingüística, traducción o resumen. También señaló que la edición intensiva, la reformulación y la traducción pueden eliminar la marca, y que apoyará la detección por parte de terceros y publicará documentación técnica más adelante.

Estos acontecimientos también advierten sobre los riesgos de la cadena de suministro. La herramienta watermarks-remover se instala como una habilidad para un agente de software y puede configurarse para clonar un repositorio de investigación de terceros y descargar un archivo de aproximadamente 220 megabytes. BleepingComputer no ha probado ni auditado las herramientas mencionadas, por lo que deben tratarse como código no confiable procedente de Internet, especialmente ante la ausencia de un medio independiente para verificar sus promesas.

Fuente de la noticia
BleepingComputer
Abrir fuente original ↗
ف
Autor

فريق تحرير certi.news

De la misma categoría

También te puede interesar

Ver todas las noticias