Show HN: CostPerPrompt – Live AI API pricing and real-workload cost calculators

개요

CostPerPrompt는 232개 이상의 AI 모델에 대한 실시간 API 가격 정보와 실제 워크로드 비용 계산기를 제공하여 챗봇, 에이전트, API 워크로드의 월별 예상 비용을 투명하게 공개하는 서비스입니다.

주요 내용

* 실시간 모델 가격 정보: 232개 이상의 AI 모델에 대한 최신 API 가격 정보를 자동으로 업데이트하여 제공합니다.
* 워크로드별 비용 계산기:
* API 비용 계산기: 캐싱 및 배치 할인을 포함하여 232개 모델 전반에 걸쳐 다양한 워크로드의 비용을 비교 분석합니다.
* 챗봇 비용 시뮬레이터: 대화 기록 증가, 컨텍스트 재전송, 캐시 히트 등을 고려한 실제 대화 시나리오를 시뮬레이션합니다.
* 에이전트 비용 분석: 다단계 루프, 툴 스키마, 재시도 등을 고려하여 에이전트 비용이 예상보다 10~30배 높을 수 있음을 보여줍니다.
* RAG 비용 계산: 인덱싱, 검색, 생성 비용을 별도로 책정하며, 임베딩 비용은 매우 저렴하다고 안내합니다.
* Voice AI 비용 계산: STT, LLM, TTS를 분당, 호출당, 월별로 통합 계산하여 총 비용을 제시합니다.
* GPU 렌탈 가격 비교: H100, A100, RTX 4090 등 다양한 GPU의 10개 제공업체별 가격을 비교합니다.
* 이미지 API 가격 정보: 이미지당 $0.003에서 $0.17까지의 가격대를 세 가지 시장 계층으로 나누어 제공하며, 배치 계산기를 포함합니다.
* 토큰 카운터: 텍스트를 붙여넣으면 어떤 모델에서든 토큰 수와 해당 비용을 브라우저 내에서 즉시 계산해 줍니다.
* 비용 절감 가이드: 프롬프트 캐싱(입력 비용 최대 90% 절감) 및 배치 API(모든 비용 약 50% 절감) 사용법을 설명합니다.
* AI API 가격 책정 방식: 입력 토큰과 출력 토큰에 대한 별도 요금이 부과되며, 출력 요금이 입력 요금보다 3~5배 더 비싼 것이 일반적이라고 설명합니다.
* 주요 할인 요인: 프롬프트 캐싱은 반복되는 입력 비용을 최대 90%까지 절감하며, 배치 처리는 결과를 기다릴 수 있는 경우 약 50%의 비용을 절감할 수 있습니다.

시사점

CostPerPrompt는 AI API 사용 비용에 대한 불확실성을 해소하고, 실제 워크로드에 기반한 정확한 비용 예측을 통해 개발자와 기업이 예산을 효과적으로 관리하고 비용을 최적화할 수 있도록 지원합니다.

원문 읽기 →
원문을 불러오는 중...

댓글

GitHub Discussions