AI API 요금 계산기 — Claude·GPT·Gemini 월 비용 비교 (2026년 9월)
Claude·GPT·Gemini API를 실제로 돌리면 한 달에 얼마가 나오는지 계산합니다. 토큰 수와 요청량을 넣으면 모델별 비용을 원화까지 한 번에 비교합니다. 가격 기준일: 2026년 9월 16일
| 모델 | 1회 | 하루 | 월(USD) | 월(원) |
|---|
계산에 쓰인 가격표
100만 토큰(1M) 기준 달러 가격입니다. 캐시 입력은 같은 프롬프트를 반복해서 보낼 때 적용되는 할인 가격입니다.
| 모델 | 입력 | 캐시 입력 | 출력 |
|---|---|---|---|
| Claude Opus 5 | $5.00 | $0.50 | $25.00 |
| Claude Sonnet 5 | $2.00 | $0.20 | $10.00 |
| Claude Haiku 4.5 | $1.00 | $0.10 | $5.00 |
| GPT-5.6 Terra | $2.00 | $0.20 | $12.00 |
| GPT-5.6 Luna | $0.20 | $0.02 | $1.20 |
| GPT-5 Nano | $0.05 | $0.005 | $0.40 |
| Gemini 3.1 Pro (≤200K) | $2.00 | $0.20 | $12.00 |
| Gemini 3.8 Flash | $0.75 | $0.075 | $3.75 |
| Gemini 3.5 Flash-Lite | $0.30 | $0.03 | $2.50 |
| Gemini 2.5 Flash-Lite | $0.10 | $0.01 | $0.40 |
비용을 줄이는 4가지 방법
1. 출력 토큰이 비용을 지배한다
모든 모델에서 출력 단가가 입력 단가의 5~6배입니다. 계산기에서 출력 토큰만 두 배로 올려보면 총액이 어떻게 튀는지 바로 보입니다. “간결하게 답하라”는 한 줄 지시가 모델 교체보다 절감 폭이 큰 경우가 많습니다.
2. 캐시 적중률을 올리면 입력값이 10분의 1
같은 시스템 프롬프트나 같은 문서를 반복해서 보낸다면 캐시 가격이 적용됩니다. 대체로 원래 입력가의 10% 수준입니다. 계산기의 캐시 적중률을 0에서 80으로 올려보세요.
주의할 점은 캐시가 앞부분부터 정확히 일치해야 적용된다는 것입니다. 시스템 프롬프트에 현재 시각처럼 매번 바뀌는 값을 넣으면 그 뒤 내용 전체가 캐시에서 빠집니다.
3. 급하지 않으면 배치 API로 절반
세 회사 모두 배치 처리에 50% 할인을 적용합니다. 즉시 응답이 필요 없는 작업(야간 일괄 요약, 대량 분류)이라면 그대로 절반입니다.
4. 싼 모델이 늘 싸지는 않다
저가 모델이 한 번에 못 끝내서 재시도가 두세 번 붙으면 총액은 오히려 올라갑니다. 비교 기준은 요청 1회 단가가 아니라 작업 하나를 끝내는 데 든 비용이어야 합니다.
주의사항
- 한글 토큰 환산은 1자 ≈ 1.4토큰으로 잡은 어림값입니다. 모델마다 토크나이저가 달라 실제와 차이가 납니다. 정확한 값이 필요하면 각 API의 토큰 카운트 기능을 쓰세요.
- Gemini의 캐시 가격에는 별도의 저장 시간당 요금이 붙습니다. 이 계산기에는 반영하지 않았습니다.
- 추론(thinking) 토큰은 출력 토큰으로 과금됩니다. 추론을 쓰는 모델이라면 출력 토큰을 넉넉히 잡으세요.
- 이미지, 오디오, 영상 입력은 별도 단가입니다. 이 계산기는 텍스트 기준입니다.
- 환율 기본값은 2026년 9월 15일 기준 1,359원입니다. 직접 수정할 수 있습니다.
가격 출처: Anthropic·OpenAI·Google 공식 요금 페이지, 2026년 9월 16일 확인. 가격은 자주 바뀌므로 규모 있는 도입 전에는 공식 페이지를 다시 확인하세요.