Claude · ChatGPT · Gemini API 월간 사용료를 정확하게 계산하세요
AI API 비용은 토큰(Token) 단위로 과금됩니다. 토큰은 텍스트를 처리하는 단위로, 한국어 기준으로 대략 1글자 = 1~2토큰으로 이해하면 됩니다. 영어는 평균적으로 4글자가 1토큰 정도입니다.
비용은 입력 토큰(Input)과 출력 토큰(Output)을 구분하여 계산합니다. 일반적으로 출력 토큰이 입력 토큰보다 3~5배 비쌉니다.
| 모델 | 입력 (per 1M) | 출력 (per 1M) | 특징 |
|---|---|---|---|
| DeepSeek V3 | $0.27 | $1.10 | ⭐ 초저가 오픈소스 경쟁력 |
| Gemini 2.0 Flash | $0.075 | $0.30 | 구글 최저가 |
| GPT-4o mini | $0.15 | $0.60 | OpenAI 최저가 |
| Claude Haiku 4.5 | $0.80 | $4.00 | 가장 빠르고 저렴 |
| OpenAI o3-mini | $1.10 | $4.40 | 추론 특화 경제형 |
| Gemini 2.0 Pro | $1.25 | $5.00 | 구글 주력 |
| GPT-4o | $2.50 | $10.00 | OpenAI 주력 모델 |
| Claude Sonnet 4.6 | $3.00 | $15.00 | 성능·가격 균형 최우수 |
| Claude Opus 4.7 | $15.00 | $75.00 | Anthropic 최고 성능 |
| OpenAI o1 | $15.00 | $60.00 | 고급 추론 모델 |
DeepSeek V3는 입력 $0.27/출력 $1.10로 GPT-4o 대비 최대 10배 저렴합니다. 일반적인 텍스트 생성·요약·번역·코드 작성에서 GPT-4o급 성능을 보여주므로, 예산에 민감한 프로젝트에 가장 먼저 검토하세요.
복잡한 수학·논리 추론이 필요하다면 OpenAI o1($15/$60) 대신 o3-mini($1.10/$4.40)를 우선 사용하세요. 대부분의 추론 벤치마크에서 o3-mini가 o1과 비슷한 성능을 내면서 비용은 약 13분의 1 수준입니다.
Claude API는 반복되는 시스템 프롬프트를 캐시하여 입력 비용을 최대 90% 절감할 수 있습니다. 긴 시스템 프롬프트를 고정하고 사용자 입력만 변경하는 패턴에서 특히 효과적입니다.
단순 분류·요약·번역은 Haiku 4.5, GPT-4o mini, Gemini 2.0 Flash처럼 저렴한 모델로 처리하고, 복잡한 추론이나 창작 작업에만 고급 모델을 사용하세요. 워크플로우를 라우팅하면 전체 비용이 60~80% 줄어드는 경우가 많습니다.
max_tokens 파라미터로 출력 길이를 필요한 만큼만 제한하세요. 출력 토큰은 입력보다 3~5배 비쌉니다. 또한 급하지 않은 대량 작업은 Batch API(Claude·OpenAI 모두 50% 할인)를 활용하면 비용을 절반으로 줄일 수 있습니다.
토큰(Token)은 AI가 텍스트를 처리하는 최소 단위입니다. 언어마다 토큰화 방식이 다릅니다:
정확한 토큰 수는 Anthropic의 Tokenizer 도구나 OpenAI의 tiktoken 라이브러리로 확인할 수 있습니다.