Booksellers suspect AI firms are buying and then destroying rare books
개요
AI 기업들이 AI 모델 학습을 위해 희귀 도서를 대량 구매하고 파괴하는 관행에 대해 서적 판매업자들이 우려를 표하고 있으며, 이러한 행위가 장기적으로 문화적 자산의 손실을 초래할 수 있다는 지적이 나오고 있다.
주요 내용
* AI 기업들이 최신 AI 모델을 빠르게 개발하기 위해 방대한 양의 텍스트 데이터, 특히 고품질의 장문 텍스트를 포함하는 도서를 대량으로 스캔하고 있으며, 이 과정에서 물리적인 파괴를 수반하는 방식을 택하고 있어 희귀 도서의 영구적 손실에 대한 우려가 제기된다.
* Google은 2009년에 비파괴적인 방식의 도서 스캔 기술을 특허 받았으나, AI 기업들은 비용 및 속도 측면에서 이를 비효율적으로 여겨 채택하지 않고 있다.
* Internet Archive는 수년 전부터 훼손이 쉬운 희귀 도서까지도 분리하지 않고 한 페이지씩 정성껏 스캔하는 수작업 방식을 고수하며 도서 보존에 힘쓰고 있으며, 이러한 방식은 AI 기업들의 자동화된 대량 스캔 방식과 대조된다.
* 최근 몇몇 AI 기업들이 도서를 파괴하여 AI를 학습시키는 행위가 언론 보도를 통해 알려지면서, 서적 판매업자들은 의심스러운 대량 주문을 감지하고 AI 기업과의 거래를 거부하려는 움직임을 보이고 있다.
* 일부 AI 기업(예: OpenAI, Microsoft, xAI)은 희귀 도서를 파괴하지 않고 학습시키거나 보존하겠다고 발표했으나, 그 진정성에 대한 회의적인 시각도 존재한다.
시사점
AI 기술 발전 과정에서 발생하는 문화 유산 파괴 가능성은 기술 발전의 속도와 문화적 가치 보존 사이의 균형에 대한 중요한 질문을 제기하며, 도서 판매업자들의 우려와 Internet Archive의 보존 방식은 기술 업계가 실질적인 책의 가치를 존중하는 방안을 모색해야 함을 시사한다.
댓글
GitHub Discussions