Claude Fable 5.1 and Claude Mythos 5.1

개요

Anthropic이 Claude Fable 5.1과 Claude Mythos 5.1을 출시하며 코딩 및 지식 작업 분야에서 AI 모델의 성능과 연구 역량을 향상시켰습니다.

주요 내용

* Claude Fable 5.1 및 Claude Mythos 5.1 출시: 두 모델은 동일한 기반 모델이지만, Mythos 5.1은 사이버 보안 및 생명 과학 분야의 작업을 지원하기 위해 특정 세이프가드가 강화된 버전으로, 신뢰할 수 있는 액세스 프로그램을 통해 제한적으로 제공됩니다. Fable 5.1은 일반에 공개됩니다.
* 가격 인하: Fable 5.1은 토큰당 과금 기준, Fable 5 대비 일반적인 워크로드에서 약 25%, 에이전트 작업 시 최대 45% 저렴해졌습니다. 이는 사전 처리된 입력(캐시 읽기)에 대한 가격 인하에 기인합니다.
* 데이터 보존 정책 강화: Enterprise Frontier Safeguards(EFS)를 통해 고객에게 제로 데이터 보존과 동일한 수준의 개인 정보 보호를 제공하면서도 악의적인 사용을 방지합니다. EFS는 고객이 통제하는 클라우드 인프라에 데이터를 저장하며, 단계적으로 기업 고객에게 제공될 예정입니다. EFS 도입 전까지는 자격 있는 고객에게 제로 데이터 보존으로 Fable 5.1을 사용할 수 있게 합니다.
* 세이프가드 개선: Fable 5.1은 거짓 양성(무해한 콘텐츠를 잘못 플래그하는 경우)을 줄이도록 세이프가드가 개선되었습니다. 사이버 보안 분야에서 이전 대비 60% 적은 거짓 양성을 차단하며, 소프트웨어 취약점 발견에 사용될 수 있습니다 (취약점 악용 개발에는 사용 불가). 생명 과학 분야에서는 미국 정부와 협력하여 Claude Mythos 5.1의 고급 생명 과학 기능을 활용할 수 있는 액세스 프로그램을 개발했습니다.
* 성능 향상: Fable 5.1은 코딩, 지식 작업, 장기 문제 해결 작업에서 이전 모델인 Fable 5 대비 상당한 성능 향상을 보였습니다. Terminal-Bench-Science 0.1, Agentic coding, Knowledge work 등 다양한 벤치마크에서 우수한 결과를 나타냈습니다.
* 과학 연구 기여: Claude Mythos 5.1은 고친화성 바인더 디자인, 새로운 고해상도 금성 고도 지도 생성, 계산 생물학 모델의 GPU 커널 최적화를 통한 실행 속도 향상 등 과학 연구 분야에서 AI의 기여 가능성을 보여줍니다.
* 안전, 보안 및 정렬 강화: Fable 5.1 및 Mythos 5.1은 화학 및 생물학적 위험, 사이버 위험, 에이전트 안전, 정렬 등 다양한 영역에서 광범위한 테스트를 거쳤습니다. Mythos 5.1은 이전 모델 대비 전반적으로 더 나은 정렬 상태를 보였으며, 악의적인 요청이나 프롬프트 주입에 대한 거부율이 높았습니다.
* EU AI Act 준수: Claude 출력물에 투명성 워터마크를 추가했으며, 감지 API를 통해 워터마크 포함 여부를 확인할 수 있도록 제공합니다.
* 가격 및 가용성: Fable 5.1은 Claude API, AWS, Google Cloud, Microsoft Azure 등 모든 플랫폼에서 이용 가능합니다. Mythos 5.1은 사이버 보안 및 생명 과학 분야의 검증된 전문가에게 신뢰할 수 있는 액세스 프로그램을 통해 제공됩니다.

시사점

Claude Fable 5.1과 Claude Mythos 5.1은 AI 모델의 성능, 비용 효율성, 안전성을 개선했으며, 특히 과학 연구 분야에서의 AI 활용 가능성을 넓혔습니다.

원문 읽기 →
원문을 불러오는 중...

댓글

GitHub Discussions