How Claude marks AI-generated content
개요
Anthropic은 생성 AI 모델 및 시스템 제공업체로서 EU AI Act의 투명성 관련 규정을 준수하기 위해 Claude가 생성한 콘텐츠에 머신 판독 가능한 워터마크와 서명된 출처 메타데이터를 포함하는 방안을 발표했습니다.
주요 내용
- 머신 판독 가능한 표시 도입: AI 생성 콘텐츠의 투명성을 높이고 소비자가 정보의 출처를 파악하는 데 도움을 주기 위해 Claude 생성 콘텐츠에 머신 판독 가능한 표시를 포함할 계획입니다.
- 텍스트 임베디드 워터마크: 지원되는 Claude 모델이 텍스트를 생성할 때, 텍스트 자체에 사람이 인지할 수 없는 워터마크를 삽입합니다. 이 워터마크는 텍스트의 의미, 품질, 가독성에 영향을 주지 않으며, 복사/붙여넣기 시에도 유지될 수 있습니다. 워터마킹은 모델 레벨에서 적용됩니다.
- 서명된 출처 메타데이터: Claude가 지원되는 파일 형식(.svg, .png, .jpg 등)을 생성할 때, Coalition for Content Provenance and Authenticity (C2PA) 표준을 따르는 서명된 출처 메타데이터를 첨부합니다. 이 메타데이터는 파일이 Claude에 의해 처리되었음을 신호하고 파일 변조 여부를 탐지하는 데 사용됩니다.
- 표시 탐지 기능 개발: 사용자와 제3자가 Claude의 임베디드 워터마크 및 출처 메타데이터를 탐지할 수 있는 기능을 개발 중이며, 향후 기술 문서에서 탐지 메커니즘에 대한 상세 정보를 공유할 예정입니다.
- 실무 적용 가이드라인: Claude를 자체 제품에 배포하는 경우, EU 코드의 약속에 따라 공급업체는 자체 제품 및 서비스에 대한 Article 50의 요구 사항을 독립적으로 평가해야 하며, Anthropic은 관련 기술 가이드라인을 제공할 예정입니다.
시사점
Claude의 AI 생성 콘텐츠에 대한 투명성 강화 노력은 EU AI Act 규정 준수뿐만 아니라, AI 기술 발전에 따른 정보 신뢰성 확보에 기여할 수 있으며, 개발자에게는 자체 제품의 투명성 의무 이행을 지원하는 기반을 제공합니다.
원문을 불러오는 중...
댓글
GitHub Discussions