도널드 트럼프 미국 대통령 행정부는 대규모 언어 모델을 학습시키기 위해 저작권 보호 자료를 허가 없이 사용하는 것은 불법이라고 주장하는 The New York Times의 소송에서 OpenAI의 입장을 지지하는 20쪽 분량의 의견서를 법원에 제출했다. 의견서는 미국의 인공지능 분야 경쟁력을 유지하기 위해 이러한 사용을 계속하는 것이 중요하다고 옹호한다.
의견서는 미국이 «인공지능의 실행과 절차에 관한 세계적 기준을 제시하는 강력하고 경쟁력 있는 인공지능 산업을 계속 발전시키는 데 강한 이해관계가 있다»고 말한다. 또한 이러한 입장을 트럼프가 지난해 서명한 행정명령과 연결하며, 해당 행정명령은 인공지능 분야에서 미국의 세계적 리더십을 유지할 것을 촉구한다.
쟁점의 핵심: 학습은 공정한 이용인가?
ChatGPT, Claude, Gemini와 같은 모델은 출판된 도서, 기사, 미디어 저작물을 포함한 방대한 데이터베이스에 의존한다. 인공지능 기업들은 이러한 저작물을 모델 학습에 사용하는 것이 저작권법의 «공정한 이용» 원칙에 해당할 수 있다고 말한다. 공정한 이용은 특정 상황에서 타인의 저작물을 허가 없이 사용할 수 있도록 허용하는 예외다.
그러나 이 원칙을 인공지능 학습에 적용하는 문제는 여전히 광범위한 법적 논쟁의 대상이다. 논의는 특히 학습 과정에서 저작물을 사용하는 행위가 충분히 «변형적»인지, 즉 원저작물을 복제하거나 대체하는 대신 원저작물과 다른 기능이나 결과물을 만들어 내는지에 초점을 맞춘다.
미국 행정부의 의견서는 공정한 이용 원칙에 대한 잘못된 이해로 인해 대규모 언어 모델의 개발을 제한하면 창의적·과학적 발전이 저해되고 미국의 번영과 경제적 이동성이 훼손될 수 있다고 경고한다.
정부의 개입으로 무엇이 달라지는가?
이 의견서는 법원의 판결이 아니며, 이를 작성한 기관에도 소송을 결정할 권한이 없다. 이 사건은 미국 뉴욕 남부지방법원이 심리하므로 최종 결정은 여전히 법원에 달려 있다. 그럼에도 행정부의 개입은 공식적인 정부 입장을 의미하며, 출판사와 작가들이 모델 학습에 자신들의 저작물을 사용하는 범위를 정하려는 시점에 OpenAI의 주장에 정치적·법적 무게를 더할 수 있다.
사건의 선행 판결들은 인공지능 학습과 저작권에 관한 소송의 결과가 지금까지 대체로 인공지능 기업에 유리했음을 보여준다. 지난해 William Alsup 판사는 Anthropic에 작가 단체에 15억 달러의 합의금을 지급하라고 명령했다. 그러나 이 제재는 인공지능 모델 학습 자체와 관련된 것이 아니라, 학습에 사용된 도서를 불법 복제하기 위해 사용한 불법적인 섀도 라이브러리와 관련된 것이었다.
Alsup은 Anthropic의 모델 학습을 작가가 되기 위해 사람이 책을 읽는 것에 비유하며, 모델이 저작물과 경쟁하거나 이를 대체하기 위해서가 아니라 다른 방향으로 나아가 새로운 것을 만들어 내기 위해 저작물을 학습했다고 말했다.
이 소식이 중요한 이유는 무엇인가?
이번 전개는 학습 데이터에 관한 싸움이 한 기업에 국한된 것이 아니라, 인공지능 기업이 사전 라이선스 계약 없이 출판된 콘텐츠를 사용할 수 있는 능력을 좌우할 수 있는 법적 경로와 관련된 문제임을 보여준다. 반면 의견서는 핵심적인 법적 쟁점을 해결하지 않으며, 법원이 공정한 이용에 대한 정부의 해석을 받아들일지도 밝히지 않는다. 합법적인 학습과 불법 복제 자료의 사용 또는 원저작물의 재생산 사이의 경계는 여전히 이 사건에서 가장 중요한 미해결 문제 가운데 하나다.