기술

Anthropic, Claude 텍스트의 워터마크 작동 방식 설명

Anthropic은 Claude 모델이 생성하는 텍스트에 보이지 않는 워터마크를 추가할 계획이다. 이를 통해 텍스트 작성에 Claude가 관여했을 가능성을 추정할 수 있으며, 품질이나 비용에는 사실상 영향을 주지 않는다. 회사는 이번 조치가 유럽 인공지능법 준수를 위한 것이라고 밝혔으며, 워터마크가 제공되면 전 세계적으로 적용할 예정이다.

2026-08-14
3 분 읽기
16 조회수
فريق تحرير certi.news
Anthropic, Claude 텍스트의 워터마크 작동 방식 설명

Anthropic은 향후 Claude 모델에 텍스트 워터마크 기능을 도입할 계획이다. 이를 통해 적절한 키를 가진 사람은 Claude가 텍스트 생성에 관여했을 가능성을 추정할 수 있다. 회사는 2026년 8월 14일자 게시물에서 워터마크가 독자에게 보이지 않으며, 숨겨진 문자나 식별 정보를 추가하지 않고, 추가 토큰을 요구하거나 모델 운영 비용을 높이지 않는다고 설명했다.

이번 조치는 Anthropic이 유럽연합 인공지능법을 준수하기 위한 것이다. Anthropic은 다른 주요 모델 제공업체 및 총 약 190개 서명 기관과 함께 2026년 7월 인공지능으로 생성된 콘텐츠의 투명성에 관한 유럽 관행 규범에 서명했다. Anthropic에 따르면 유럽연합은 8월 2일부터 유럽 시장에 서비스를 제공하는 인공지능 제공업체에 자동 생성 콘텐츠 표시를 의무화했다.

워터마크는 어떻게 작동하는가?

언어 모델은 한 번에 한 단어씩 텍스트를 생성하며, 각 단계에서 여러 개의 가능한 단어 중 하나를 선택한다. 여러 선택지가 의미와 품질 면에서 비슷한 경우, 워터마크는 키와 앞선 단어들의 집합을 사용해 선택을 결정하는 무작위성의 원천을 정한다. 따라서 선택은 실질적으로 무작위로 유지되지만, 단어의 배열에는 나중에 키를 사용해 탐지할 수 있는 패턴이 남는다.

Anthropic은 이 기능이 Claude가 평소에는 사용하지 않았을 단어를 선택하도록 유도하지 않으며, 항상 특정 단어를 선호하도록 만들지도 않는다고 밝혔다. 회사는 이를 주사위를 던지는 대신 파이 값에서 가져온 숫자열을 사용하는 것에 비유했다. 결과는 무작위로 보이지만, 결과의 연속을 분석하면 무작위성의 원천을 밝혀낼 수 있다는 설명이다.

텍스트 품질에는 사실상 영향이 없다

내부 테스트에 따르면 Anthropic은 Claude 텍스트의 내용이나 창의성, 가독성에 영향을 발견하지 못했다. 또한 Gemini 트래픽의 일부를 대상으로 기술을 시험한 SynthID-Text 연구를 언급하며, 워터마크가 있는 텍스트와 없는 텍스트의 평가에서 통계적으로 유의미한 차이가 나타나지 않았다고 설명했다. 통제된 연구에서는 인간 평가자들이 답변을 나란히 비교했을 때 품질 차이를 알아차리지 못했다.

회사는 워터마크가 모델의 속도를 아주 조금만 늦추며, 추가 토큰을 생성하지 않기 때문에 서비스 비용도 높이지 않는다고 강조했다. 또한 워터마크에는 사용자나 사용자의 기관 또는 대화를 드러낼 수 있는 정보가 포함되지 않는다.

탐지의 한계와 편집 및 프로그래밍 사례

탐지 효과는 텍스트의 길이와 모델이 적절한 선택지를 둘 이상 갖는 결정의 수에 따라 달라진다. 따라서 짧은 샘플이나 정확한 답변 하나만 허용되는 사실적 구절에서는 탐지가 더 약하다. 예를 들어 아이작 뉴턴의 저작에 대한 정확한 이름을 언급하는 경우가 이에 해당한다. 가벼운 문법 교정도 마찬가지다. 대부분의 단어가 사용자가 작성한 것이므로 watermark가 의존할 만한 정보가 충분하지 않다.

프로그래밍에서는 정확한 출력이 필수적인 경우 일반적으로 워터마크가 적용되지 않는다. 단어나 기호 하나를 바꾸는 것만으로도 코드가 작동하지 않을 수 있기 때문이다. 다만 주석처럼 임의로 선택할 수 있는 부분에는 워터마크가 나타날 수 있으며, 코드 자체에는 영향이 거의 없다. 반면 Claude가 생성하는 번역에는 모델이 모든 단어를 선택하므로 워터마크가 포함된다.

제공 시점과 워터마크가 입증하는 것

Anthropic은 워터마크를 탐지하기 위한 애플리케이션 프로그래밍 인터페이스를 제공하기 위해 작업 중이지만, 아직 구현 세부 사항은 정하지 않았다. 회사는 현재 지역별로 워터마크를 제한할 지속 가능한 방법이 없기 때문에 출시 시 전 세계적으로 적용할 예정이다. 또한 유럽 법률이 규정한 전환 기간을 활용해 2026년 8월 2일 이전에 출시된 Claude 모델에도 이를 추가하는 작업을 진행하고 있으며, 이는 앞으로 몇 달 동안 이루어질 예정이다.

워터마크는 Claude가 텍스트 전체를 작성했다는 것을 입증하지 않는다. 워터마크는 Claude가 텍스트 생성이나 처리에 관여했을 가능성만 나타내며, 원본 작성과 대대적인 편집을 구분하지 않는다. 텍스트를 완전히 다시 작성하면 워터마크가 제거될 수 있지만, 가벼운 편집으로는 제거되지 않을 수 있다. 워터마크는 사용자의 권리나 콘텐츠 소유권 또는 이에 대한 법적 책임을 변경하지 않는다.

PNG, JPG, SVG 등 지원되는 파일의 경우 Claude는 C2PA 개방형 표준에 따라 파일 메타데이터에 암호학적으로 서명된 메모 형식의 콘텐츠 인증 정보를 추가할 예정이다. Anthropic은 이 데이터가 파일을 변경하지 않으며 식별 정보를 포함하지 않고, C2PA 호환 도구로 읽을 수 있다고 밝혔다.

뉴스 출처
Anthropic Newsroom
원문 보기 ↗
ف
작성자

فريق تحرير certi.news

같은 카테고리

추천 기사

모든 뉴스 보기