인공지능

OpenAI, API를 통해 생성된 텍스트의 선택적 표식을 제공하고 코드에서의 탐지 어려움을 경고

OpenAI는 API를 통해 생성되는 텍스트에 통계적 신호를 삽입하는 textGrain 시스템을 출시했으며, 이 기능은 기본적으로 비활성화된 상태로 프로젝트 또는 조직 단위에서 고객이 활성화할 수 있다. 회사는 텍스트가 짧거나 편집되면 탐지 효과가 떨어지고 코드의 경우 더 어려운 상황이라고 설명했다. 한편 유럽연합 내 ChatGPT와 Codex에서는 앞으로 몇 주 안에 적격 텍스트에 자동으로 표식을 적용하기 시작할 예정이다.

2026-10-05
3 분 읽기
2 조회수
certi.news Editorial Team
OpenAI, API를 통해 생성된 텍스트의 선택적 표식을 제공하고 코드에서의 탐지 어려움을 경고

OpenAI는 API를 통해 자사 모델이 생성하는 텍스트에 표식을 부여하는 textGrain 시스템을 제공한다고 발표했지만, 이 기능은 기본적으로 비활성화된 상태로 유지된다. 전 세계 고객은 오늘부터 지원되는 모델에서 이 기능을 활성화할 수 있으며, 개별 API 요청을 수정하지 않고도 프로젝트 또는 조직 단위로 설정할 수 있다.

이 시스템은 문맥상 두 선택지가 모두 타당할 때 다른 대안보다 적절한 단어에 가중치를 부여하는 방식으로 텍스트에 ‘통계적 신호’를 삽입한다. 이러한 선택이 충분히 긴 텍스트에 누적되면 OpenAI의 탐지기가 해당 패턴을 식별할 수 있을 것으로 예상된다.

Anthropic과 다른 선택

OpenAI는 8월에 Anthropic이 Claude 모델에 대해 발표한 접근 방식보다 API 고객에게 더 큰 통제권을 부여한다. Anthropic은 지원되는 모델에 전 세계적으로, 모델 수준에서 표식을 적용할 것이라고 밝혔다. 여기에는 Claude 및 Claude Code 제품과 API 사용이 포함되지만, 개발자가 이를 비활성화할 수 있는 유사한 선택권이 있는지는 설명하지 않았다.

OpenAI에 따르면 앞으로 몇 주 안에 유럽연합 내 ChatGPT와 Codex가 생성하는 적격 텍스트에 표식을 자동으로 적용하기 시작한다. 이는 유럽 인공지능법의 투명성 요건에 대응하기 위한 것이다. 회사는 Codex에서 ‘적격 출력’이 정확히 무엇을 의미하는지는 아직 구체적으로 밝히지 않았다.

탐지 효과는 일정하지 않다

OpenAI는 자사의 탐지기가 길이 200토큰인 표식 적용 구간의 약 80%를 포착하며, 심리학과 같은 분야의 400토큰 구간에서는 그 비율이 95%로 상승한다고 말한다. 목표 오탐률은 1%다. 수학처럼 제약이 큰 자료에서는 탐지 능력이 떨어지는데, 이는 모델이 단어를 선택할 수 있는 선택지가 더 적기 때문이다.

텍스트를 편집하면 신호도 뚜렷하게 약해진다. 회사의 테스트에서 400토큰 구간의 단어 10%를 동의어로 바꾸자 탐지율이 약 92%에서 66%로 떨어졌고, 25%를 바꾸자 17%까지 하락했다. OpenAI는 짧은 구간에는 신뢰할 수 있는 탐지에 충분한 자료가 포함되지 않을 수 있다고도 경고한다.

코드는 더 어려운 시험 사례

OpenAI는 문법적·논리적 제약으로 인해 다음 단어 또는 토큰에 대해 합리적인 선택지가 줄어들기 때문에 일반적인 산문보다 코드에 표식을 적용하기가 더 어렵다고 인정한다. 회사는 textGrain을 활성화하거나 비활성화한 Astra 모델을 DeepSWE, AutomationBench, Terminal-Bench 테스트를 통해 비교했으며, 성능에서 의미 있는 차이를 발견하지 못했다고 밝혔다. 그러나 이러한 결과만으로는 표식이 적용된 코드가 수정되거나 재포맷된 뒤 얼마나 신뢰성 있게 식별되는지 입증할 수 없다.

현재 textGrain을 활성화한 API 고객은 탐지 도구를 자동으로 제공받지 않는다. OpenAI는 텍스트의 출처와 탐지의 신뢰성을 연구하는 승인된 연구 및 학술 기관으로 초기 탐지기 접근을 제한하고 있다. 한편 The New Stack은 Codex의 적격 출력과 코드에 대한 탐지율에 관한 추가 세부 정보를 회사에 요청했다.

이 소식이 중요한 이유

개발자에게 실질적인 변화는 텍스트 표식이 모든 API 출력에 강제로 적용되는 동작이 아니라 관리 가능한 선택 사항이 되었다는 점이다. 그러나 공개된 수치는 표식만으로 결정적인 증거가 될 수 없음을 보여준다. 텍스트를 줄이거나 편집하면 탐지 가능성이 낮아지고, 코드에는 신호를 삽입할 충분한 여지가 없을 수 있다. 따라서 탐지기의 사용 범위와 접근 가능성, 실제 코드에서의 시스템 성능은 여전히 해결되지 않은 질문으로 남아 있다.

뉴스 출처
The New Stack - Software Development
원문 보기 ↗
c
작성자

certi.news Editorial Team

같은 카테고리

추천 기사

모든 뉴스 보기