Технологии

Anthropic объясняет механизм водяного знака в текстах Claude

Anthropic намерена добавить невидимый водяной знак в тексты, создаваемые моделями Claude, что позволит оценивать вероятность участия Claude в их написании практически без влияния на качество или стоимость. Компания заявляет, что этот шаг предпринимается во исполнение европейского закона об искусственном интеллекте, а после внедрения водяной знак будет запущен во всём мире.

2026-08-14
4 мин. чтения
16 просмотров
فريق تحرير certi.news
Anthropic объясняет механизм водяного знака в текстах Claude

Anthropic намерена оснастить будущие модели Claude механизмом водяного знака для текстов, который позволит владельцу соответствующего ключа оценивать вероятность того, что Claude участвовал в создании текста. Компания пояснила в публикации от 14 августа 2026 года, что знак не будет виден читателям, не будет добавлять скрытые символы или метаданные, а также не потребует дополнительных токенов и не повысит стоимость работы модели.

Этот шаг предпринимается в рамках соблюдения Anthropic закона Европейского союза об искусственном интеллекте. В июле 2026 года компания вместе с другими ведущими поставщиками моделей и примерно 190 другими подписантами в общей сложности подписала европейский свод правил прозрачности контента, созданного с помощью искусственного интеллекта. По словам Anthropic, с 2 августа Европейский союз требует от поставщиков ИИ, обслуживающих его рынок, маркировать контент, созданный автоматически.

Как работает водяной знак?

Языковые модели генерируют текст слово за словом, на каждом шаге выбирая одно из нескольких вероятных слов. Когда несколько вариантов близки по смыслу и качеству, водяной знак использует ключ и набор предыдущих слов для определения источника случайности, который принимает решение о выборе. Таким образом, выбор практически остаётся случайным, но последовательность слов оставляет закономерность, которую позднее можно обнаружить с помощью ключа.

Anthropic заявляет, что этот механизм не заставляет Claude выбирать слова, которые он обычно не использовал бы, и не делает его постоянно склонным к одному конкретному слову. Компания сравнивает это с использованием последовательности цифр из числа пи вместо броска игральной кости: результат выглядит случайным, однако анализ последовательности результатов может выявить источник случайности.

Практически никакого влияния на качество текста

Согласно внутренним испытаниям, Anthropic не обнаружила влияния на содержание, креативность или удобочитаемость текстов Claude. Компания также ссылается на исследование SynthID-Text, в котором технология была протестирована на части трафика Gemini и не было выявлено статистически значимых различий между оценками текстов с водяным знаком и без него. В контролируемом исследовании люди-оценщики не смогли заметить разницу в качестве при сравнении ответов бок о бок.

Компания подчёркивает, что водяной знак лишь незначительно замедляет работу моделей и не делает сервис дороже, поскольку не создаёт дополнительных токенов. Он также не содержит сведений, способных раскрыть личность пользователя, его организацию или его разговоры.

Ограничения обнаружения, редактирование и программирование

Эффективность обнаружения зависит от длины текста и количества решений, при которых у модели есть более одного подходящего варианта. Поэтому обнаружение слабее в коротких образцах и в фактических фрагментах, допускающих только один точный ответ, например при указании правильного названия работы Исаака Ньютона. То же относится к лёгкой языковой корректуре: большинство слов остаётся написанным пользователем, и водяному знаку не хватает материала, на который можно было бы опереться.

В программировании водяной знак обычно не применяется, когда необходим точный вывод, поскольку изменение слова или символа может сломать код. Однако он может появляться в местах со случайным выбором, например в комментариях к коду, при незначительном влиянии на сам код. Перевод, созданный Claude, напротив, содержит водяной знак, поскольку модель выбирает все его слова.

Доступность и то, что доказывает водяной знак

Anthropic работает над предоставлением интерфейса программирования приложений для обнаружения водяного знака, однако пока не определила подробности его реализации. При запуске водяной знак будет применяться во всём мире, поскольку в настоящее время у компании нет устойчивого способа ограничить его использование по регионам. Компания также работает над добавлением знака в модели Claude, выпущенные до 2 августа 2026 года, используя предусмотренный европейским законом переходный период; это должно произойти в ближайшие месяцы.

Водяной знак не доказывает, что Claude полностью написал текст: он лишь определяет вероятность того, что модель участвовала в его создании или обработке, и не различает исходное написание и существенное редактирование. Полная перепись текста может удалить водяной знак, тогда как лёгкое редактирование может его сохранить. Водяной знак не меняет права пользователя, право собственности на контент или юридическую ответственность за него.

Для поддерживаемых файлов, таких как PNG, JPG и SVG, Claude будет добавлять данные о происхождении контента в виде криптографически подписанной записи в метаданных файла в соответствии с открытым стандартом C2PA. Anthropic заявляет, что эти данные не изменяют файл и не содержат идентифицирующей информации; их смогут читать инструменты, совместимые с C2PA.

Источник новости
ف
Автор

فريق تحرير certi.news

В той же категории

Вам также может понравиться

Все новости