Advancing the price-performance frontier with GPT‑5.6
개요
GPT‑5.6 모델 제품군이 API 성능 향상 및 가격 인하를 통해 고객에게 더 나은 가치를 제공하며, AI를 활용한 업무 처리 효율성을 높입니다.
주요 내용
* GPT‑5.6 Luna 및 Terra 가격 인하: 가장 빠르고 저렴한 모델인 GPT‑5.6 Luna는 80% 인하, 일상 업무에 적합한 GPT‑5.6 Terra는 20% 인하되었습니다. 이러한 가격 인하는 Codex 및 ChatGPT Work 사용 시에도 적용됩니다.
* GPT‑5.6 Luna의 활용성 증대: Luna 모델은 높은 품질을 유지하면서도 대량의 작업을 비용 효율적으로 처리할 수 있으며, 도구 사용 및 다단계 워크플로우 수행이 가능하여 AI 애플리케이션의 대규모 적용을 현실화합니다.
* GPT‑5.6 Sol API 성능 향상 (Fast mode): GPT‑5.6 Sol 모델은 API의 Fast mode를 통해 기존 Standard processing 대비 최대 2.5배 빠른 속도를 제공하며, 가격은 2배로 책정됩니다. Fast mode는 기존 Priority Processing을 대체하며, 'priority' 태그가 붙은 요청은 자동으로 Fast mode를 사용합니다.
* AI 효율성 최적화: 고객은 AI 워크플로우의 특정 단계에서 요구되는 결과, 품질, 속도, 비용 간의 균형을 맞추기 위해 GPT‑5.6 모델 패밀리의 다양한 선택지를 활용할 수 있습니다. 예를 들어, 복잡한 문제 해결에는 Sol을, 명확한 작업 수행에는 Luna를 사용하는 방식입니다.
* 효율성 증대 기술: OpenAI는 모델 자체의 개선, 추론 시스템 최적화, 도구 및 컨텍스트 연결을 위한 에이전트 하네스 강화를 통해 효율성을 높이고 있습니다. GPT‑5.6 Sol은 생산 커널 최적화, 토큰 생성 효율성 향상 실험, 훈련 모니터링 및 문제 해결을 통해 모델 서빙 비용을 20% 절감하고 토큰 생성 효율성을 15% 이상 향상시키는 데 기여했습니다.
* 확장 가능한 컴퓨팅 전략: OpenAI는 탄력적인 인프라 포트폴리오 구축과 워크로드에 최적화된 시스템 매칭을 통해 컴퓨팅 자원을 확보하고 있으며, 이를 통해 저비용 대량 처리와 최첨단 성능 모두를 지원합니다.
* API 가격 및 가용성: 7월 30일부터 GPT‑5.6 Terra는 API에서 입력 토큰당 $2, 출력 토큰당 $12이며, Luna는 입력 토큰당 $0.20, 출력 토큰당 $1.20입니다. Sol 가격은 변경되지 않습니다. ChatGPT Work 및 Codex의 구독 가격 및 할당량은 변동 없으나, Terra 및 Luna 사용 시 더 적은 크레딧을 소모합니다.
시사점
이러한 GPT‑5.6 모델의 가격 경쟁력 강화와 성능 개선은 AI 도입 비용을 절감하고, 다양한 규모의 AI 애플리케이션 구축 및 운영을 촉진하여 기업의 혁신을 가속화할 수 있습니다.
댓글
GitHub Discussions