미국 정부, 저작물 학습 논란서 OpenAI 편 들어
뉴욕타임스가 OpenAI를 상대로 제기한 소송에서 트럼프 행정부가 20페이지 분량의 의견서를 제출하며 OpenAI의 무단 저작물 활용 LLM 학습을 옹호했습니다. 의견서는 공정 이용(fair use) 원칙을 근거로 저작물 학습 제한이 미국 AI 산업 경쟁력을 저해한다고 주장했습니다. 이는 판결은 아니지만 AI 업계에 유리한 흐름을 강화하는 신호로 평가됩니다.
뉴욕타임스가 OpenAI를 상대로 제기한 소송에서, 트럼프 행정부는 ChatGPT 개발사가 허가 없이 저작물을 활용해 LLM을 학습시킨 행위를 옹호하는 20페이지 분량의 의견서를 제출했다. 의견서는 "미국은 AI 활용의 실천과 절차에 대한 글로벌 표준을 정하는 강건하고 경쟁력 있는 인공지능 산업을 지속적으로 발전시키는 데 큰 이해관계를 갖고 있다… 그러므로 미국이 '인공지능 분야의 글로벌 리더십을 유지'하는 것이 중요하다"라고 밝히며, 트럼프 대통령이 작년에 서명한 행정명령을 인용했다.
ChatGPT, Claude, Gemini 같은 챗봇을 구동하는 LLM은 저작권이 있는 책, 기사, 기타 미디어를 포함해 이해하기 어려울 만큼 방대한 데이터베이스로 학습되며, AI 기업들은 이러한 데이터를 허가 없이 수집해왔다. 이번 사건의 뉴욕타임스를 포함한 많은 출판사들은 OpenAI 같은 AI 기업이 자신들의 저작물로 AI 모델을 학습시키는 것이 불법이라고 주장해왔다.
'저작물로 AI를 학습시킬 수 있는가'라는 이 질문은 흑백논리로 답할 수 있는 문제가 아니며, 그래서 이 주제를 둘러싼 광범위한 법적 논쟁이 이어지고 있다. 이러한 논의는 대체로 공정 이용(fair use)에 초점이 맞춰져 있는데, 이는 타인의 저작물을 허가 없이 사용하는 특정 상황에서 합법으로 인정할 수 있도록 저작권법에서 예외를 두는 조항이다. 이번 사건에서 공정 이용 논쟁의 쟁점은 AI 기업의 저작물 활용이 판사가 합법이라고 판결할 만큼 '변혁적(transformative)'인지 여부다. 의견서는 "공정 이용 원칙에 대한 오해 아래 LLM 개발을 제약하는 것은 창의적·과학적 진보를 가로막고 미국의 번영과 경제적 유동성을 저해할 것"이라고 주장한다.
지금까지 AI 학습과 저작권 침해 관련 사건들은 대체로 AI 기업에게 유리하게 흘러갔다. 작년 윌리엄 알숩 판사는 Anthropic에게 자사 AI 모델 학습에 사용된 저작물의 원작자들에게 15억 달러의 저작권 합의금을 지급하라고 명령했지만, Anthropic은 AI 학습 자체로는 처벌받지 않았다. 오히려 이 회사는 학습에 사용할 책을 불법 섀도우 라이브러리에서 해적판으로 구한 행위로 벌금을 물었다. 알숩 판사는 LLM의 학습을 인간이 책을 읽는 것에 비유하며 "작가를 꿈꾸는 독자처럼, Anthropic의 LLM은 작품을 앞질러 복제하거나 대체하기 위해 학습한 것이 아니라 새로운 방향으로 전환해 다른 것을 창조하기 위해 학습했다"라고 판시했다.
이번 트럼프 행정부의 의견서는 판결이 아니다. 해당 사건은 미국 뉴욕 남부연방지방법원에서 심리 중이며, 의견서 작성자들에게는 관할권이 없다. 그러나 트럼프 행정부의 이러한 개입은 여전히 상당한 무게를 실어줄 수 있다.