OpenAI seeks to one-up Anthropic with new customer privacy protections

개요

OpenAI는 고객 데이터 유지를 최소화하면서 AI 모델의 오용을 감지하는 새로운 프라이버시 중심 안전 시스템인 Private Safety Processing을 선보이며 경쟁사인 Anthropic에 차별화 전략을 제시했습니다.

주요 내용

* Private Safety Processing 출시: OpenAI는 선택된 고객을 대상으로 새로운 서비스인 Private Safety Processing의 미리보기 버전을 공개했습니다. 이 시스템은 자동화된 방식으로 잠재적 오용을 감시하지만 고객 데이터를 전혀 보유하지 않습니다.
* Anthropic의 데이터 보존 정책과의 대조: 이 시스템은 Anthropic의 최근 데이터 보존 정책과 직접적으로 대조됩니다. Anthropic은 "커버된 모델"에 대해 최대 30일간 사용자 세션 데이터를 보존하여 안전 목적으로 분석할 수 있도록 합니다.
* Zero Data Retention (ZDR) 확대: OpenAI는 기존 Zero Data Retention (ZDR) 정책을 확장하는 Private Safety Processing을 새로운 기술로 설명합니다. ZDR은 OpenAI API 내의 에이전트를 사용하여 세션별로 오용을 모니터링하지만 데이터를 보유하지 않습니다.
* 장기 안전 모니터링: Private Safety Processing은 한 번의 대화뿐만 아니라 여러 대화의 입력과 출력을 평가하는 일종의 장기 안전 모니터링을 제공합니다.
* 다중 세션에서의 악의적 사용 감지: 새로운 기술은 악성 사용자(예: 사이버 공격을 위한 악성코드 엔지니어링 시도)가 탐지를 피하기 위해 여러 세션에 걸쳐 요청을 분산하는 경우에도 이를 감지하는 데 도움을 줍니다.
* 트리거 시 신호 전달: 시스템이 트리거되면 OpenAI에 특정 유형의 활동을 경고하는 "좁게 정의된 신호"를 보낼 수 있으며, 이에 따라 OpenAI는 추가 조치를 결정합니다.
* 고객 참여: 시스템 트리거 시 OpenAI는 고객에게 연락하여 추가 정보를 요청하거나 문제를 협력하여 해결할 수 있으며, 고객은 자발적으로 데이터를 공유할 수 있습니다.
* Anthropic의 인간 검토 절차: 대조적으로 Anthropic은 인간 검토가 가능하지만, "작은 규모의 승인된 검토자"만 접근할 수 있는 "통제된 접근 경로"를 통해 이루어지며 모든 검토 세션은 "변조 불가능한 로그에 기록"됩니다.
* 경쟁 환경: OpenAI와 Anthropic 간의 경쟁이 치열하며, 두 회사 모두 이점을 얻기 위한 기회를 모색하고 있습니다.

시사점

OpenAI의 Private Safety Processing 도입은 AI 안전과 사용자 프라이버시 사이의 균형을 맞추는 업계의 노력을 보여주며, 고객 데이터의 민감성을 중시하는 기업에게 중요한 선택지를 제공합니다.

원문 읽기 →
원문을 불러오는 중...

댓글

GitHub Discussions