← Lecture Note
D
APPENDIX · 부록

비용 계산기

LLM / STT / TTS / Blob 월간 추정

💰 월간 비용 계산기
모델 티어
1,500
월 대화 수
$18.0
LLM/월
≈ $19
월 합계(추정)

* 단가 대략값(Sonnet 입력 $3·출력 $15 / Haiku급 입력 $0.8·출력 $4, 1M 토큰당). 임베딩·저장은 소액이라 +$1로 합산. Prompt Caching·출력 상한으로 더 줄일 수 있어요.

AI Agent 서비스의 월간 비용을 항목별로 추정합니다. 아래 표는 대략값(2025~2026 기준, 변동 가능)이며, 페이지 상단의 계산기로 내 사용량을 직접 넣어볼 수 있습니다.

단가 레퍼런스 (대략)

항목모델/서비스단가(대략)
LLM 입력Claude Sonnet~$3 / 1M 토큰
LLM 출력Claude Sonnet~$15 / 1M 토큰
LLM(저렴)Haiku / GPT-4o-mini입력 $0.20.8 / 1M
임베딩text-embedding-3-small~$0.02 / 1M 토큰
STTElevenLabs Scribe~$0.4 / 시간(요금제별)
TTSElevenLabs월 10k자 무료, 이후 요금제
저장Vercel Blob1GB 무료, 이후 GB당
호스팅Vercel Hobby무료(개인)

예시 월간 추정

가벼운 데모(일 50대화, 답변 평균 500토큰, 입력 1k토큰)

  • LLM: 50×30일 = 1,500회 → 입력 1.5M×$3 + 출력 0.75M×$15 ≈ $16/월
  • 임베딩: 쿼리당 ~수백 토큰 → <$1
  • 합계 ≈ $15~20/월 (Haiku로 바꾸면 $23)

음성 포함 서비스(일 200대화 + STT/TTS)

  • LLM ≈ $6080 + 음성 요금제(유료 티어) → **$50150/월** 수준

비용 절감 4수칙

  1. 모델 티어 분리: 분류·간단 응답은 Haiku/mini, 복잡 추론만 Sonnet/Opus.
  2. Prompt Caching: 반복되는 시스템 프롬프트·RAG 청크 캐시 → 최대 90% 절감.
  3. 출력 토큰 제한: max_tokens로 상한. 출력이 입력보다 비싸다.
  4. 한국어 최적화: 반복 프롬프트는 영어로(토큰 2.5x 절약), RAG는 무료 in-memory부터.

핵심 정리

  • 비용의 대부분은 LLM 출력 토큰. 모델 티어 + caching + 출력 상한이 핵심.
  • 무료 한도(Anthropic/OpenAI 크레딧, Vercel/ElevenLabs 무료)만으로 학습·소규모 데모는 충분.