US government sides with OpenAI on issue of training LLMs on copyrighted material
개요
미국 정부는 뉴욕타임스가 OpenAI를 상대로 제기한 소송에서, 저작권이 있는 자료를 LLM 훈련에 사용하는 것에 대해 OpenAI의 입장을 지지하는 의견서를 제출했습니다.
주요 내용
* 미국 정부는 OpenAI와의 소송에서 20페이지 분량의 의견서를 통해, LLM 훈련을 위한 저작권 자료의 무단 사용에 대해 ChatGPT 제작사를 옹호했습니다.
* 의견서에 따르면, 미국은 전 세계 AI 사용의 표준을 정립하는 강력하고 경쟁력 있는 인공지능 산업을 지속적으로 개발하는 데 큰 이해관계를 가지고 있으며, 이는 행정 명령에도 명시된 바 있습니다.
* ChatGPT, Claude, Gemini와 같은 챗봇에 사용되는 LLM은 책, 기사 등 저작권이 있는 출판물을 포함하는 방대한 데이터베이스를 통해 훈련되며, AI 기업들은 이러한 자료를 허가 없이 사용합니다.
* 뉴욕타임스를 포함한 많은 출판사들은 AI 기업이 저작권이 있는 자료로 AI 모델을 훈련하는 것이 불법이라고 주장하고 있습니다.
* 이 논쟁의 핵심은 저작권법의 예외 조항인 '공정 이용(fair use)'이며, AI 기업의 저작권 자료 사용이 이를 법적으로 허용할 만큼 "변형적(transformative)"인지 여부가 쟁점입니다.
* 정부 의견서는 '공정 이용' 교리에 대한 오해로 LLM 개발이 제약받으면 창의적, 과학적 진보가 저해되고 미국 경제 성장과 기회가 방해될 수 있다고 주장합니다.
* 지금까지 AI 훈련 및 저작권 침해 관련 소송에서는 AI 기업에게 유리한 판결이 주로 내려졌습니다.
* 과거 앤트로픽(Anthropic)은 AI 훈련 자체가 아닌, 훈련에 사용된 도서를 불법적으로 복제한 '섀도 라이브러리'를 사용한 혐의로 작가 그룹에게 15억 달러의 저작권 합의금을 지급하라는 판결을 받았으나, AI 훈련 자체는 문제가 되지 않았습니다.
* 판사는 앤트로픽의 LLM 훈련 과정을 인간이 책을 읽고 새로운 것을 창조하는 것에 비유했습니다.
* 트럼프 행정부의 이번 의견서는 법적 판결은 아니지만, 해당 사건이 미국 뉴욕 남부 지방 법원에서 진행 중인 만큼 영향력을 가질 수 있습니다.
시사점
미국 정부의 이번 개입은 AI 산업의 성장과 혁신을 지원하고, 저작권법의 '공정 이용' 원칙이 AI 기술 발전에 미치는 영향을 신중하게 고려해야 함을 시사합니다.
댓글
GitHub Discussions