В интернете появился быстрорастущий рынок инструментов, утверждающих, что они удаляют водяные знаки из текстов, создаваемых искусственным интеллектом, спустя несколько дней после объявления Anthropic об активации невидимых знаков во всём, что пишет Claude. На этом рынке представлены проект с открытым исходным кодом, набравший более 4500 звёзд на GitHub, ряд недавно зарегистрированных сайтов и коммерческие сервисы, специализирующиеся на обходе инструментов обнаружения контента, созданного искусственным интеллектом.
Однако в настоящее время невозможно проверить заявления этих инструментов об удалении текстового водяного знака, поскольку Anthropic ещё не опубликовала подробности механизма его работы и не запустила общедоступный инструмент обнаружения, с помощью которого можно было бы определить, сохраняется ли знак в очищенном тексте.
Различные проекты и сервисы
Среди наиболее заметных проектов — инструмент watermarks-remover под лицензией MIT, разработанный Guillaume Meyer, основателем Memo. Изначально инструмент был создан как специализированный навык для агента Claude, а затем объявил о поддержке Claude, Gemini и SynthID-Text, а также поверхностей доказательства происхождения OpenAI и моделей с открытыми весами, использующих знаки по методу Kirchenbauer.
Наряду с ним существуют другие репозитории, такие как claude-watermark-cleaner, remove-ai-watermarks и noai-watermark, а также недавно появившиеся сайты, включая claudewatermark.com, claudewatermark.rip, gptcleanup.com и claudewatermarkremover.app. StealthGPT — сервис, продающий инструменты для обхода обнаружения контента, созданного искусственным интеллектом, — также добавил инструмент для удаления знака Claude на страницы своих сервисов. В свою очередь, Human Writes заявляет об обходе Turnitin и GPTZero в статьях и заданиях, одновременно утверждая, что удаляет знак Claude, хотя и снабжает свои материалы предупреждением о необходимости использовать сервис в соответствии с политиками академической добросовестности.
Что именно удаляют эти инструменты?
Инструменты работают с тремя разными типами данных. Удаление скрытых символов, таких как символы нулевой ширины, управляющие символы двунаправленного текста, специальные символы Unicode и пробелы, похожие на обычные пробелы, — это процесс, который можно проверить и измерить. То же относится к удалению метаданных C2PA, EXIF и XMP из файлов PNG, JPEG, SVG, PDF, DOCX, ODT, HTML и Markdown. Однако эти данные обычно не сохраняются после повторного сохранения файла, преобразования его формата или создания снимка экрана.
Сам текстовый водяной знак не содержится в скрытых символах, а связан со словами, которые выбирает модель. Поэтому известный способ борьбы с ним заключается в значительной переработке текста с помощью другой модели. Meyer поясняет, что в настоящее время его инструмент удаляет только метаданные, а фактическое удаление знаков может появиться позднее, но пока недоступно.
Некоторые коммерческие сайты обещают создавать чистый и необнаруживаемый текст, однако часть результатов сравнивается с общедоступными инструментами обнаружения, а не со знаком Anthropic, для которого общедоступного инструмента обнаружения не существует. Pasquale Pillitteri, клонировав проекты и изучив код, также обнаружил, что один из популярных инструментов очистки текста оставил без изменений распространённую технологию хранения скрытых данных: после заявления инструмента об очистке содержимое удалось расшифровать и восстановить.
Причина нанесения знаков и риски цепочки поставок
Anthropic заявила, что тексты, выданные моделями, выпущенными 2 августа 2026 года или позднее, содержат незаметный водяной знак, встроенный в формулировки, тогда как поддерживаемые типы файлов получают подписанные данные C2PA. Маркировка применяется на уровне модели через API, claude.ai, Claude Code, Claude Cowork и Claude Tag, а также через AWS, Google Cloud и Microsoft Foundry.
Эта мера связана со статьёй 50 Европейского закона об искусственном интеллекте, применение которой вступило в силу 2 августа; предусмотрены штрафы до 15 миллионов евро или 3% мирового дохода. Anthropic поясняет, что обнаружение знака означает, что контент был обработан Claude, но не обязательно полностью написан им: знак может появиться при использовании модели для проверки языка, перевода или суммирования. Компания также указала, что интенсивное редактирование, перефразирование и перевод могут удалить знак, и сообщила, что будет поддерживать обнаружение сторонними организациями и позднее опубликует техническую документацию.
Эти события также предупреждают о рисках цепочки поставок. Инструмент watermarks-remover устанавливается как навык программного агента и может быть настроен на клонирование исследовательского репозитория третьей стороны и загрузку файла размером около 220 мегабайт. BleepingComputer не тестировала и не проверяла упомянутые инструменты, поэтому к ним следует относиться как к ненадёжному коду из интернета, особенно в отсутствие независимого способа проверить их обещания.