💰 월간 비용 계산기
모델 티어
1,500
월 대화 수
$18.0
LLM/월
≈ $19
월 합계(추정)
* 단가 대략값(Sonnet 입력 $3·출력 $15 / Haiku급 입력 $0.8·출력 $4, 1M 토큰당). 임베딩·저장은 소액이라 +$1로 합산. Prompt Caching·출력 상한으로 더 줄일 수 있어요.
AI Agent 서비스의 월간 비용을 항목별로 추정합니다. 아래 표는 대략값(2025~2026 기준, 변동 가능)이며, 페이지 상단의 계산기로 내 사용량을 직접 넣어볼 수 있습니다.
단가 레퍼런스 (대략)
| 항목 | 모델/서비스 | 단가(대략) |
|---|---|---|
| LLM 입력 | Claude Sonnet | ~$3 / 1M 토큰 |
| LLM 출력 | Claude Sonnet | ~$15 / 1M 토큰 |
| LLM(저렴) | Haiku / GPT-4o-mini | 입력 |
| 임베딩 | text-embedding-3-small | ~$0.02 / 1M 토큰 |
| STT | ElevenLabs Scribe | ~$0.4 / 시간(요금제별) |
| TTS | ElevenLabs | 월 10k자 무료, 이후 요금제 |
| 저장 | Vercel Blob | 1GB 무료, 이후 GB당 |
| 호스팅 | Vercel Hobby | 무료(개인) |
예시 월간 추정
가벼운 데모(일 50대화, 답변 평균 500토큰, 입력 1k토큰)
- LLM: 50×30일 = 1,500회 → 입력 1.5M×$3 + 출력 0.75M×$15 ≈ $16/월
- 임베딩: 쿼리당 ~수백 토큰 → <$1
- 합계 ≈ $15~20/월 (Haiku로 바꾸면
$23)
음성 포함 서비스(일 200대화 + STT/TTS)
- LLM ≈ $60
80 + 음성 요금제(유료 티어) → **$50150/월** 수준
비용 절감 4수칙
- 모델 티어 분리: 분류·간단 응답은 Haiku/mini, 복잡 추론만 Sonnet/Opus.
- Prompt Caching: 반복되는 시스템 프롬프트·RAG 청크 캐시 → 최대 90% 절감.
- 출력 토큰 제한:
max_tokens로 상한. 출력이 입력보다 비싸다. - 한국어 최적화: 반복 프롬프트는 영어로(토큰 2.5x 절약), RAG는 무료 in-memory부터.
핵심 정리
- 비용의 대부분은 LLM 출력 토큰. 모델 티어 + caching + 출력 상한이 핵심.
- 무료 한도(Anthropic/OpenAI 크레딧, Vercel/ElevenLabs 무료)만으로 학습·소규모 데모는 충분.
