He Scraped All of Their Art for AI. Now He’s Collaborating on a Tool to Help Them
개요
Cara 앱의 아티스트들이 AI 모델 학습에 무단으로 사용되는 것을 막기 위해 출시된 이미지 공유 플랫폼이 대규모 스크래핑 공격을 받았으나, 공격 주체와 플랫폼 운영진이 협력하여 아티스트를 보호할 새로운 오픈소스 도구를 개발하고 있다.
주요 내용
* Cara 앱의 등장 및 목적: Jingna Zhang이 2023년 초 출시한 Cara는 150만 명의 아티스트가 참여하며, AI 모델 학습에 자신들의 작품이 무단 사용되는 것에 반대하고 작품을 홍보하는 동시에 기술 기업에 의한 착취를 피하고자 하는 아티스트들을 끌어들였다. Cara는 AI 이미지를 필터링하고 스타일을 마스킹하는 Glaze와 같은 보호 기능을 제공한다.
* 연속적인 스크래핑 공격 발생: 2023년 8월, Cara는 세 차례의 대규모 스크래핑 공격을 받았다. 첫 번째 공격자는 12TB에 달하는 Cara의 공개 이미지 전체 라이브러리를 수집하여 Reddit에 공유했으며, 이는 아티스트 커뮤니티에 큰 충격을 주었다. 두 번째 공격자는 850만 개의 링크와 사용자 메타데이터를 수집하여 Hugging Face에 업로드했다. 세 번째 공격자는 123,000개의 이미지와 개인 정보가 포함된 텍스트 게시물 및 사용자 프로필을 수집하여 Academic Torrents에 공유했다.
* 운영진의 법적 대응 및 사용자들의 동요: Cara 운영진은 서버 비용 급증, 사용자들의 이탈, 법적 대응을 위한 GoFundMe 모금(목표 $120,000, 현재 $100,000 이상 모금) 등을 통해 어려움을 겪고 있다. Jingna Zhang은 이러한 공격에 대해 법적 보호가 미비한 점을 지적하며, 다른 플랫폼으로 이동해도 안전이 보장되지 않는다고 강조했다.
* 공격자의 반성과 협력: 첫 번째 스크래핑 공격의 주체인 "MandarinDawnPoppy994"(본명 비공개, "Heft"로 알려짐)는 아티스트들의 고통을 목격하고 자신의 행동을 후회하며 Cara 운영진과 협력하기로 했다. Heft는 소프트웨어 배경을 가진 학생으로, 자신의 행동이 아티스트들에게 준 충격을 인지하고, Cara의 취약점을 분석하며 새로운 도구 개발에 참여하고 있다.
* 새로운 보호 도구 "Lantern" 개발: Heft와 Jingna Zhang은 "Lantern"이라는 오픈소스 도구를 개발 중이다. 이 도구는 아티스트들이 자신의 이미지에 대해 "단방향 지문"을 생성할 수 있도록 하며, 공개된 AI 이미지 데이터셋을 스캔하여 아티스트의 작품이 포함된 경우 알림을 제공하고 제거 요청 또는 테이크다운 통지를 제출할 수 있도록 지원한다.
시사점
Cara 앱을 대상으로 발생한 스크래핑 사건은 AI 학습 데이터 수집에 대한 윤리적, 법적 문제를 수면 위로 끌어올렸으며, 아티스트들이 자신의 작품을 보호하고 통제할 수 있도록 지원하는 기술적 해결책의 필요성을 부각시키고 있다.
댓글
GitHub Discussions