Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
개요
Google은 AI 에이전트 구축에 필요한 효율성, 지연 시간, 안정성을 개선한 새로운 Gemini Flash 모델 시리즈인 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber를 발표했습니다.
주요 내용
* Gemini 3.6 Flash:
* Gemini 3.5 Flash 대비 출력 토큰 사용량을 17% 감소시키고, DeepSWE 벤치마크에서는 최대 65%까지 감소시켜 비용 효율성을 높였습니다.
* 코딩, 지식 작업, 멀티모달 성능이 향상되었으며, 3.5 Flash 대비 더 적은 추론 단계와 도구 호출로 다단계 워크플로우를 완료합니다.
* 입력 토큰당 $1.50, 출력 토큰당 $7.50의 가격으로 에이전트당 총 비용을 절감합니다.
* DeepSWE (49% vs 37%), MLE Bench (63.9% vs 49.7%), OSWorld-Verified (83.0% vs 78.4%) 등 다양한 벤치마크에서 3.5 Flash 대비 성능 향상을 보였습니다.
* 화학, 생물학, 방사능, 핵(CBRN) 및 사이버 공격 오용 영역에서 강화된 프런티어 안전 기능이 적용되어 탈옥 방지에 더 효과적입니다.
* Gemini 3.5 Flash-Lite:
* 3.5 시리즈 중 가장 빠른 모델로, 초당 350개의 출력 토큰을 처리합니다 (Artificial Analysis).
* 입력 토큰당 $0.3, 출력 토큰당 $2.5의 가격으로 높은 처리량과 비용 효율성을 제공하여 에이전트 검색 및 문서 처리와 같은 작업에 적합합니다.
* 3.1 Flash-Lite 대비 코딩, 에이전트 작업, 긴 컨텍스트 처리, 실제 작업 실행 등 전반적인 성능이 크게 향상되었습니다.
* Terminal-Bench 2.1 (54% vs 31%), GDM-MRCR v2 (72.2% vs. 60.1%), GDPval-AA v2 (1140 vs. 642) 벤치마크에서 우수한 성능을 보였습니다.
* 일부 에이전트 및 코딩 평가에서는 3.5 Flash보다 뛰어난 성능을 보여 2.5 및 3 Flash의 워크로드에 더 빠르고 효율적인 옵션을 제공합니다.
* Gemini 3.5 Flash Cyber:
* 3.5 Flash를 기반으로 하며, 사이버 보안 취약점을 찾고 수정하는 데 특화되었습니다.
* CodeMender 코드 보안 에이전트와 함께 사용되어 경쟁력 있는 성능을 제공하며, 대형 모델보다 낮은 토큰당 가격으로 취약점을 탐지, 검증 및 패치합니다.
* 현재 정부 및 신뢰할 수 있는 파트너를 대상으로 제한된 액세스 파일럿 프로그램을 통해 제공될 예정입니다.
시사점
새롭게 출시된 Gemini Flash 모델들은 AI 에이전트 구축에 있어 비용 효율성, 속도, 안정성을 대폭 향상시켜 개발자들이 대규모로 복잡한 워크플로우를 구축하고 배포할 수 있도록 지원하며, 특히 사이버 보안 분야에서 혁신적인 솔루션을 제공합니다.
댓글
GitHub Discussions