How Google’s New Gemini Rates Work and How to Track Your Usage

개요

Google의 Gemini AI 앱은 컴퓨팅 파워 요구사항을 기준으로 AI 사용량을 측정하는 새로운 방식을 도입했으며, 다양한 유료 플랜별로 사용량 할당량이 차등 적용됩니다.

주요 내용

* AI 사용량 측정 방식 변경: 이전에는 요청 횟수를 기준으로 AI 사용량을 제한했지만, 이제는 요청의 복잡성과 컴퓨팅 파워 요구사항에 따라 사용량이 측정됩니다. 이는 Google의 데이터센터 리소스 소모량과 더 직접적으로 연관됩니다.
* 사용량에 영향을 미치는 요인: AI 사용량은 사용자가 속한 플랜(Free, Plus, Pro, Ultra), 프롬프트의 복잡성과 길이, 그리고 사용되는 Gemini AI 모델(Flash-Lite, Flash, Pro) 및 해당 모델의 '사고' 레벨(Standard, Extended, Deep Think)에 따라 달라집니다.
* 플랜별 사용량 할당량:
* Free: "표준"으로 정의된 사용량 제한을 가지며, 컨텍스트 윈도우는 32K 토큰입니다.
* AI Plus ($8/월): Free 대비 2배의 사용량 제한을 가지며, 컨텍스트 윈도우는 128K 토큰입니다.
* AI Pro ($20/월): Free 대비 4배의 사용량 제한을 가지며, 컨텍스트 윈도우는 1백만 토큰입니다.
* AI Ultra ($100 또는 $200/월): AI Pro 대비 5배 또는 20배의 사용량 제한을 가지며, 컨텍스트 윈도우는 1백만 토큰입니다.
* 모든 사용자에게 모델 접근 권한 제공: 모든 유료 및 무료 사용자는 Flash-Lite, Flash, Pro 모델에 접근할 수 있으며, 고급 모델일수록 사용량이 더 많이 차감됩니다.
* 사용량 확인 방법: Gemini 앱 웹 버전에서는 설정(톱니바퀴 아이콘) > Usage limits에서, 모바일 앱에서는 메뉴 > 설정 > Usage limits에서 현재 사용량과 주간 사용량 제한 현황을 확인할 수 있습니다.
* 사용량 초과 시: 현재 사용량 제한을 초과하면 5시간마다 초기화되는 해당 리셋 시간을 기다려야 하며, 주간 사용량 제한에 도달하면 가장 기본적인 AI 모델로 제한되어 다음 주간 리셋까지 사용해야 합니다.
* 제한 변경 가능성: Google은 용량 제약 및 테스트, 실험, 가용성 등의 이유로 AI 사용량 제한을 사전 통지 없이 변경할 수 있으며, 리소스 관리가 필요할 경우 무료 사용자가 우선적으로 영향을 받을 수 있습니다.

시사점

Google의 Gemini AI 사용량 측정 방식 변경은 사용자가 AI 기능의 비용 효율성을 이해하고 자신의 사용 패턴을 관리하는 데 영향을 미치며, 유료 플랜의 가치와 활용 방안을 고려하게 합니다.

원문 읽기 →
원문을 불러오는 중...

댓글

GitHub Discussions