AI API 비용 계산기 · Claude · GPT · Gemini 비교
모델마다 가격표를 따로 열어 보는 대신, 같은 사용량을 한 번 넣고 전부 줄 세워 봅니다. 월 요청 수까지 넣으면 실제로 얼마가 나갈지 바로 나옵니다.
어떤 작업인가요 (누르면 값이 채워집니다)
제공사
가장 싼 조합GPT-5.6 Luna$10.00/ 월· 약 14,000원
가장 비싼 Claude Fable 5 대비 45.0배 저렴합니다.
| 모델 | 입력 $/1M | 출력 $/1M | 1회 | 월 비용 |
|---|---|---|---|---|
| GPT-5.6 LunaOpenAI | 0.2 | 1.2 | $0.0010 | $10.0014,000원 |
| Gemini 3.1 Flash-LiteGoogle | 0.25 | 1.5 | $0.0013 | $12.5017,500원 |
| Gemini 3.8 FlashGoogle출시 기념가 · 2027-01-01 부터 두 배 | 0.75 | 3.75 | $0.0034 | $33.7547,250원 |
| Claude Haiku 4.5Anthropic | 1 | 5 | $0.0045 | $45.0063,000원 |
| Gemini 3.5 FlashGoogle | 1.5 | 9 | $0.0075 | $75.00105,000원 |
| Claude Sonnet 5Anthropic | 2 | 10 | $0.0090 | $90.00126,000원 |
| GPT-5.6 TerraOpenAI | 2 | 12 | $0.0100 | $100140,000원 |
| Gemini 3.1 ProGoogle20만 토큰 초과분은 $4 / $18 | 2 | 12 | $0.0100 | $100140,000원 |
| GPT-5.4OpenAI | 2.5 | 15 | $0.0125 | $125175,000원 |
| Claude Sonnet 4.6Anthropic | 3 | 15 | $0.0135 | $135189,000원 |
| Claude Opus 5Anthropic | 5 | 25 | $0.0225 | $225315,000원 |
| GPT-5.6 SolOpenAI | 5 | 30 | $0.0250 | $250350,000원 |
| Claude Fable 5Anthropic | 10 | 50 | $0.0450 | $450630,000원 |
1회 = (입력 2,000 ÷ 1M × 입력단가) + (출력 500 ÷ 1M × 출력단가) · 월 = 1회 × 10,000회
2026년 9월 9일 기준 공시가입니다. 프롬프트 캐싱·배치 할인·장기계약은 반영하지 않았습니다.
비용이 결정되는 구조
API 비용은 토큰 수로만 정해집니다. 요청 횟수가 아니라 주고받은 글의 양이 기준입니다. 그래서 같은 기능이라도 프롬프트를 절반으로 줄이면 비용도 절반이 됩니다.
| 1회 비용 | (입력토큰 ÷ 1M × 입력단가) + (출력토큰 ÷ 1M × 출력단가) |
| 월 비용 | 1회 비용 × 월 요청 수 |
출력 단가가 입력의 4~6배라는 점이 핵심입니다. 긴 문서를 읽히고 짧게 답하게 하는 작업은 싸고, 짧게 묻고 길게 쓰게 하는 작업은 비쌉니다. 같은 모델이라도 용도에 따라 비용이 열 배 이상 벌어집니다.
비용을 줄이는 방법
- 프롬프트 캐싱 — 매번 같은 지시문이나 문서를 보낸다면 캐싱으로 입력 비용을 크게 줄일 수 있습니다. 반복되는 부분을 앞쪽에 고정해 두는 것이 요령입니다.
- 배치 처리 — 즉시 응답이 필요 없는 작업은 대부분의 제공사가 절반 가격에 처리해 줍니다.
- 작업별로 모델 나누기 — 분류·추출은 저가 모델, 추론이 필요한 부분만 상위 모델로 보내면 품질을 지키면서 비용이 내려갑니다.
- 출력 길이 제한 — 가장 비싼 것이 출력입니다. 필요한 형식만 짧게 받도록 지시하는 것만으로 체감 차이가 납니다.
공식 가격 페이지
이 표는 2026년 9월 9일 기준으로 정리한 값입니다. 계약이나 예산 산정 전에는 원본을 확인하세요.
자주 묻는 질문
- 토큰이 뭔가요?
- 모델이 글을 쪼개서 세는 단위입니다. 영어는 대략 단어 하나가 1~2토큰, 한국어는 글자 하나가 1~2토큰쯤 됩니다. A4 한 장이 대략 1,000~1,500토큰이라고 보면 감이 잡힙니다.
- 입력과 출력 가격이 왜 다른가요?
- 출력이 보통 4~6배 비쌉니다. 입력은 한 번에 읽어 처리하지만 출력은 토큰을 하나씩 만들어 내기 때문입니다. 그래서 긴 문서를 넣고 짧게 답하게 하는 작업이 가장 저렴합니다.
- 가장 싼 모델을 쓰면 되나요?
- 작업에 따라 다릅니다. 분류나 추출처럼 단순한 일은 저가 모델로 충분하지만, 복잡한 추론이나 코드 작성은 상위 모델이 결과적으로 더 쌉니다. 싼 모델이 틀려서 두세 번 다시 부르면 총비용이 역전됩니다.
- 캐싱이나 배치 할인은 왜 빠져 있나요?
- 제공사마다 조건과 할인율이 달라서 일률적으로 계산하면 오히려 틀립니다. 같은 내용을 반복해서 보낸다면 프롬프트 캐싱으로 입력 비용을 크게 줄일 수 있고, 즉시 응답이 필요 없으면 배치로 절반 가격에 처리할 수 있습니다.
- 실제 청구액과 다를 수 있나요?
- 다를 수 있습니다. 이 계산은 공시가 기준이며, 추론 과정에서 생기는 토큰이나 시스템 프롬프트가 매 요청에 더해집니다. 실제 사용량은 각 제공사 대시보드에서 확인하세요.
가격은 2026년 9월 9일 기준 공시가입니다. 제공사가 예고 없이 조정할 수 있으니 실제 계약 전에는 공식 가격 페이지를 확인하세요.