OpenAI may have made a fatal misstep in copyright fight with news orgs
개요
OpenAI가 뉴욕타임스 등 언론사를 상대로 진행 중인 저작권 침해 소송에서 증거 은폐 및 삭제 혐의로 심각한 제재에 직면해 있다.
주요 내용
* 증거 은폐 및 조작 의혹: 뉴욕타임스 등 언론사들은 OpenAI가 수백만 개의 ChatGPT 로그 데이터를 검색하는 것을 방해하고, 법원에 거짓 진술을 반복하여 저작권 침해 증거를 은폐했다고 주장한다.
* 기술적 능력에 대한 거짓 진술: OpenAI는 소송 초기부터 대규모 익명화된 ChatGPT 로그 샘플을 검색할 기술적 능력이 없다고 주장했지만, 실제로는 이미 그러한 검색을 수행한 것으로 드러났다.
* 증거 숨기기 및 불완전한 데이터 제공: OpenAI는 1천만 개와 7천 8백만 개의 로그를 포함한 두 개의 대규모 샘플이 존재했음을 공개하지 않았으며, 제공된 2천만 개 로그 샘플은 AI에 의한 과도한 편집으로 인해 법원이 "사용 불가능"하다고 판단했다.
* 보존 명령 무시 및 로그 삭제: OpenAI는 법원의 광범위한 보존 명령을 준수하지 않고, 모든 채팅 기록을 보존하는 것이 어렵다는 이유로 수십억 개의 로그를 삭제하거나 압축한 것으로 알려졌다.
* 언론사의 제재 요청: 언론사들은 OpenAI의 이러한 행위가 고의적이고 의도적이었음을 강조하며, OpenAI가 2천만 개 샘플 사용을 금지당하고, 위법적인 저작물 복제 사실이 상당했음을 인정하며, 향후 주장에서 불리한 영향을 받도록 하는 등 "심각한 제재"를 법원에 요청했다.
* OpenAI 측 반박: OpenAI는 뉴욕타임스의 제재 신청이 추가 로그 접근 및 사용자 프라이버시 침해를 위한 소송 행위라고 주장하며, 언론사 측의 주장이 사실이 아니고 자신들의 방어가 약화되지 않았다고 반박했다.
시사점
OpenAI가 저작권 침해 소송에서 증거 은폐 및 조작 혐의로 심각한 제재를 받을 경우, 이는 AI 학습 과정에서의 저작권 문제에 대한 중요한 선례가 될 수 있으며, AI 개발사의 투명성 및 증거 제출 의무에 대한 경각심을 높일 수 있다.
댓글
GitHub Discussions