Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost more

개요

Google이 새롭게 공개한 Gemini 3.8 Flash 모델은 이전 모델보다 더 많은 추론 단계를 거치고 반복적으로 툴을 호출하여 복잡한 작업을 수행하며, 이에 따라 잠재적으로 더 높은 비용이 발생할 수 있습니다.

주요 내용

* 성능 향상: Gemini 3.8 Flash는 더 복잡한 작업에서 더 많은 추론 단계를 수행하고 툴을 반복적으로 호출함으로써 Gemini 3.7 Flash보다 "더 열심히 일한다"고 Google은 주장합니다.
* 가격 정책: 초기 가격은 Gemini 3.7 Flash와 동일하게 유지되었으나, 성능 최적화를 위해 더 많은 토큰을 사용할 수 있어 실제 비용이 증가할 수 있습니다. Gemini 3.7 Flash는 토큰 사용량을 최소화하려는 개발자에게 계속 제공됩니다.
* 외부 평가: Artificial Analysis는 Gemini 3.8 Flash를 동일 수준의 인공지능 모델 중 가장 저렴하다고 평가했으며, Aigora.ai CEO John Ennis는 Opus 5의 코딩 품질과 유사하지만 훨씬 저렴하고 빠르다고 언급했습니다.
* 벤치마크 성과: Gemini 3.8 Flash는 소프트웨어 엔지니어링, 자율 AI 에이전트, 금융, 법률 분야의 벤치마크에서 이전 모델 및 경쟁 모델들을 능가하는 성과를 보였습니다. 특히 DeepSWE v1.1, Vals Finance Agent V2, Harvey’s Legal Agent 벤치마크에서 우수한 성능을 나타냈습니다.
* 안전 기능: 화학, 생물학, 방사능, 핵(CBRN) 및 사이버 공격과 같은 분야에서 오용 방지를 위한 안전 기능이 포함되어 있습니다.
* Gemini 3.8 Flash Cyber 및 Fairwind Program: 정부 및 신뢰할 수 있는 파트너를 대상으로 하는 Fairwind Program과 함께 Gemini 3.8 Flash Cyber가 출시되었습니다. 이 프로그램은 Google의 CodeMender 에이전트와 함께 액세스를 제공하여 취약점을 자율적으로 찾아 수정하고 국가 안보를 보호하는 데 도움을 줄 수 있습니다.
* 접근성: Gemini 3.8 Flash는 Google AI Pro 또는 Ultra 구독자, 개발자 및 기업 사용자가 현재 이용 가능합니다.

시사점

Gemini 3.8 Flash의 출시는 AI 모델의 성능과 비용 효율성 사이의 균형점을 탐색하는 데 중요한 시사점을 제공하며, 특히 소프트웨어 엔지니어링 및 자율 에이전트 분야의 개발 속도를 가속화할 잠재력을 가지고 있습니다.

원문 읽기 →
원문을 불러오는 중...

댓글

GitHub Discussions