Is it legal to train AI models on copyrighted books? It’s complicated

개요

AI 모델 학습에 저작권이 있는 책을 사용하는 것이 합법적인지에 대한 문제는 복잡하며, 현재 법률은 이러한 새로운 기술을 완전히 포괄하지 못하고 있습니다.

주요 내용

* AI 챗봇(ChatGPT, Gemini, Claude 등)은 수백만 권의 책을 포함한 방대한 데이터베이스를 통해 학습되며, 대부분의 저자들은 동의 없이 자신들의 저작물이 AI 개발에 사용되었습니다.
* 최근 판결에서 Anthropic은 저작권 침해 소송에서 승소했으나, 이는 불법 온라인 도서관에서 책을 불법 복제한 것에 대한 벌금이었으며, AI 학습 자체는 합법적인 것으로 간주되었습니다.
* 판사는 AI 모델의 학습 과정을 작가가 문학을 연구하는 것에 비유하며, 저작권법은 '복제'보다는 '사용'이나 '경험'에 초점을 맞춘다고 해석했습니다.
* 1976년 이후 업데이트되지 않은 저작권법으로 인해, 판사들은 AI와 관련된 새로운 법적 문제에 대해 50년 전의 법률을 해석해야 하는 상황입니다.
* AI 학습의 합법성은 주로 '공정 이용(fair use)' 법리에 따라 결정되며, 저작물 사용이 '변형적(transformative)'인지가 중요한 쟁점입니다.
* 공정 이용 여부를 판단할 때, 저작물의 목적과 성격, 사용된 분량, 시장에 미치는 영향 등이 고려됩니다.
* 직접적인 경쟁을 목적으로 저작권이 있는 데이터를 학습하는 것은 법원에서 부정적으로 간주되는 경향이 있으며, 경쟁을 목적으로 하지 않는 경우에는 법원에서 합법적인 방안을 찾는 경우가 많습니다.
* AI 생성 콘텐츠 자체의 저작권에 대한 문제는 별개의 문제이며, 100% AI 생성물의 경우 저작권 등록이 거부되는 사례도 있습니다.
* AI 모델 학습과 관련된 소송들이 아직 진행 중이므로, 명확한 법적 해결책이 나오기까지는 시간이 걸릴 것이며, 현재 판결들이 AI 산업에 영향을 미치고 있습니다.

시사점

AI 모델 학습에 저작권이 있는 자료를 사용하는 문제에 대한 법적 불확실성이 존재하며, 저작권법이 기술 발전에 맞춰 어떻게 해석되고 개정될지가 AI 산업의 미래를 결정하는 중요한 요소가 될 것입니다.

원문 읽기 →
원문을 불러오는 중...

댓글

GitHub Discussions