2026 LLM API 가격 비교표 — GPT-5.6·Claude 5·Gemini 3.x 토큰 단가
OpenAI·Anthropic·Google·xAI·Mistral·DeepSeek·Perplexity·Cohere 주요 모델의 input·output 토큰 단가와 주의할 과금 항목을 한 표로 정리.
핵심 팁
LLM API 가격 비교표은(는) 포맷, 옵션, 규칙 차이를 빠르게 대조하는 개발용 표입니다. 문법을 외우기보다 어떤 상황에서 어떤 형식을 써야 하는지 정리할 때 효과적입니다.
- 입력 형식과 출력 형식을 먼저 구분해서 보세요.
- 테스트 데이터로 한 번 확인한 뒤 실데이터에 적용하세요.
- 표준 문서와 같이 보면 해석 오류를 줄일 수 있습니다.
- 관련 계산기와 해설 글을 같이 보면 실제 적용이 쉬워집니다.
| 모델 | 공급사 | Input ($/1M) | Output ($/1M) | 컨텍스트 | 캐시 지원 | 비고 |
|---|---|---|---|---|---|---|
| GPT-5.6 Sol | OpenAI | $2.50 | $15.00 | Short 기준 | ○ | 최상위 작업·코딩·에이전트 |
| GPT-5.6 Terra | OpenAI | $1.25 | $7.50 | Short 기준 | ○ | 균형형 기본 선택 |
| GPT-5.6 Luna | OpenAI | $0.50 | $3.00 | Short 기준 | ○ | 저비용 대량 처리 |
| GPT-5.5 | OpenAI | $2.50 | $15.00 | Short 기준 | ○ | 고성능 범용 |
| GPT-5.5 Pro | OpenAI | $15.00 | $90.00 | Short 기준 | — | 고비용 최고급 |
| GPT-5.4 | OpenAI | $1.25 | $7.50 | Short 기준 | ○ | 이전 세대 범용 |
| GPT-5.4 mini | OpenAI | $0.375 | $2.25 | Short 기준 | ○ | 저가 범용 |
| GPT-5.4 nano | OpenAI | $0.10 | $0.625 | Short 기준 | ○ | 초저가 분류·추출 |
| GPT-5.1 | OpenAI | $1.25 | $10.00 | 400K | ○ | 안정형 범용 |
| GPT-5.3 Codex | OpenAI | $1.75 | $14.00 | 코딩 특화 | ○ | 코드 생성·수정 |
| Claude Fable 5 | Anthropic | $10.00 | $50.00 | 200K | ○ (~90%) | 최상위 추론 |
| Claude Opus 4.8 | Anthropic | $5.00 | $25.00 | 200K | ○ (~90%) | 고성능 코딩·문서 |
| Claude Sonnet 5 (intro) | Anthropic | $2.00 | $10.00 | 200K | ○ (~90%) | 2026-08-31까지 intro |
| Claude Sonnet 5 (standard) | Anthropic | $3.00 | $15.00 | 200K | ○ (~90%) | intro 종료 후 표준가 |
| Claude Haiku 4.5 | Anthropic | $1.00 | $5.00 | 200K | ○ (~90%) | 고속·대량 처리 |
| Gemini 3.5 Flash | $1.50 | $9.00 | Gemini 3 | ○ | 속도·검색·그라운딩 | |
| Gemini 3.1 Pro Preview | $2.00 | $12.00 | <=200K 기준 | ○ | 상위 추론·멀티모달 | |
| Gemini 3.1 Flash-Lite | $0.25 | $1.50 | Gemini 3 | ○ | 초저가 대량 처리 | |
| Gemini 3 Flash Preview | $0.50 | $3.00 | Gemini 3 | ○ | Flash 계열 기본 | |
| Gemini 2.5 Pro | $1.25 | $10.00 | <=200K 기준 | ○ | 초장문·멀티모달 | |
| Gemini 2.5 Flash | $0.30 | $2.50 | 1M | ○ | 이전 Flash 계열 | |
| Grok 4.5 | xAI | $2.00 | $6.00 | 최신 stable | ○ | 코딩·에이전트·지식작업 |
| Grok 4.3 | xAI | $1.25 | $2.50 | 200K 이하 기준 | ○ | 저비용 범용 |
| Mistral Large 3 | Mistral | $0.50 | $1.50 | 모델별 상이 | — | 오픈웨이트·멀티모달 |
| Mistral Medium 3.5 | Mistral | $1.50 | $7.50 | 모델별 상이 | ○ | 상용 균형형 |
| Mistral Small 4 | Mistral | $0.15 | $0.60 | 모델별 상이 | — | 경량·고속 |
| DeepSeek V4 Flash | DeepSeek | $0.435 | $0.87 | 모델별 상이 | ○ | 저가 추론·에이전트 |
| DeepSeek V3 | DeepSeek | $0.27 | $1.10 | 128K | ○ | 고성능·초저가 |
| DeepSeek R1 | DeepSeek | $0.55 | $2.19 | 128K | ○ | 추론 특화 |
| Sonar | Perplexity | $1.00 | $1.00 | 검색 context별 | — | 검색 request fee 별도 |
| Sonar Pro | Perplexity | $3.00 | $15.00 | 검색 context별 | — | 검색 request fee 별도 |
| Sonar Reasoning Pro | Perplexity | $2.00 | $8.00 | 검색 context별 | — | 검색 request fee 별도 |
| Command A | Cohere | $2.50 | $10.00 | 256K | — | 기업용 에이전트 |
- GPT-5.6 Sol
- 공급사
- OpenAI
- Input ($/1M)
- $2.50
- Output ($/1M)
- $15.00
- 컨텍스트
- Short 기준
- 캐시 지원
- ○
- 비고
- 최상위 작업·코딩·에이전트
- GPT-5.6 Terra
- 공급사
- OpenAI
- Input ($/1M)
- $1.25
- Output ($/1M)
- $7.50
- 컨텍스트
- Short 기준
- 캐시 지원
- ○
- 비고
- 균형형 기본 선택
- GPT-5.6 Luna
- 공급사
- OpenAI
- Input ($/1M)
- $0.50
- Output ($/1M)
- $3.00
- 컨텍스트
- Short 기준
- 캐시 지원
- ○
- 비고
- 저비용 대량 처리
- GPT-5.5
- 공급사
- OpenAI
- Input ($/1M)
- $2.50
- Output ($/1M)
- $15.00
- 컨텍스트
- Short 기준
- 캐시 지원
- ○
- 비고
- 고성능 범용
- GPT-5.5 Pro
- 공급사
- OpenAI
- Input ($/1M)
- $15.00
- Output ($/1M)
- $90.00
- 컨텍스트
- Short 기준
- 캐시 지원
- —
- 비고
- 고비용 최고급
- GPT-5.4
- 공급사
- OpenAI
- Input ($/1M)
- $1.25
- Output ($/1M)
- $7.50
- 컨텍스트
- Short 기준
- 캐시 지원
- ○
- 비고
- 이전 세대 범용
- GPT-5.4 mini
- 공급사
- OpenAI
- Input ($/1M)
- $0.375
- Output ($/1M)
- $2.25
- 컨텍스트
- Short 기준
- 캐시 지원
- ○
- 비고
- 저가 범용
- GPT-5.4 nano
- 공급사
- OpenAI
- Input ($/1M)
- $0.10
- Output ($/1M)
- $0.625
- 컨텍스트
- Short 기준
- 캐시 지원
- ○
- 비고
- 초저가 분류·추출
- GPT-5.1
- 공급사
- OpenAI
- Input ($/1M)
- $1.25
- Output ($/1M)
- $10.00
- 컨텍스트
- 400K
- 캐시 지원
- ○
- 비고
- 안정형 범용
- GPT-5.3 Codex
- 공급사
- OpenAI
- Input ($/1M)
- $1.75
- Output ($/1M)
- $14.00
- 컨텍스트
- 코딩 특화
- 캐시 지원
- ○
- 비고
- 코드 생성·수정
- Claude Fable 5
- 공급사
- Anthropic
- Input ($/1M)
- $10.00
- Output ($/1M)
- $50.00
- 컨텍스트
- 200K
- 캐시 지원
- ○ (~90%)
- 비고
- 최상위 추론
- Claude Opus 4.8
- 공급사
- Anthropic
- Input ($/1M)
- $5.00
- Output ($/1M)
- $25.00
- 컨텍스트
- 200K
- 캐시 지원
- ○ (~90%)
- 비고
- 고성능 코딩·문서
- Claude Sonnet 5 (intro)
- 공급사
- Anthropic
- Input ($/1M)
- $2.00
- Output ($/1M)
- $10.00
- 컨텍스트
- 200K
- 캐시 지원
- ○ (~90%)
- 비고
- 2026-08-31까지 intro
- Claude Sonnet 5 (standard)
- 공급사
- Anthropic
- Input ($/1M)
- $3.00
- Output ($/1M)
- $15.00
- 컨텍스트
- 200K
- 캐시 지원
- ○ (~90%)
- 비고
- intro 종료 후 표준가
- Claude Haiku 4.5
- 공급사
- Anthropic
- Input ($/1M)
- $1.00
- Output ($/1M)
- $5.00
- 컨텍스트
- 200K
- 캐시 지원
- ○ (~90%)
- 비고
- 고속·대량 처리
- Gemini 3.5 Flash
- 공급사
- Input ($/1M)
- $1.50
- Output ($/1M)
- $9.00
- 컨텍스트
- Gemini 3
- 캐시 지원
- ○
- 비고
- 속도·검색·그라운딩
- Gemini 3.1 Pro Preview
- 공급사
- Input ($/1M)
- $2.00
- Output ($/1M)
- $12.00
- 컨텍스트
- <=200K 기준
- 캐시 지원
- ○
- 비고
- 상위 추론·멀티모달
- Gemini 3.1 Flash-Lite
- 공급사
- Input ($/1M)
- $0.25
- Output ($/1M)
- $1.50
- 컨텍스트
- Gemini 3
- 캐시 지원
- ○
- 비고
- 초저가 대량 처리
- Gemini 3 Flash Preview
- 공급사
- Input ($/1M)
- $0.50
- Output ($/1M)
- $3.00
- 컨텍스트
- Gemini 3
- 캐시 지원
- ○
- 비고
- Flash 계열 기본
- Gemini 2.5 Pro
- 공급사
- Input ($/1M)
- $1.25
- Output ($/1M)
- $10.00
- 컨텍스트
- <=200K 기준
- 캐시 지원
- ○
- 비고
- 초장문·멀티모달
- Gemini 2.5 Flash
- 공급사
- Input ($/1M)
- $0.30
- Output ($/1M)
- $2.50
- 컨텍스트
- 1M
- 캐시 지원
- ○
- 비고
- 이전 Flash 계열
- Grok 4.5
- 공급사
- xAI
- Input ($/1M)
- $2.00
- Output ($/1M)
- $6.00
- 컨텍스트
- 최신 stable
- 캐시 지원
- ○
- 비고
- 코딩·에이전트·지식작업
- Grok 4.3
- 공급사
- xAI
- Input ($/1M)
- $1.25
- Output ($/1M)
- $2.50
- 컨텍스트
- 200K 이하 기준
- 캐시 지원
- ○
- 비고
- 저비용 범용
- Mistral Large 3
- 공급사
- Mistral
- Input ($/1M)
- $0.50
- Output ($/1M)
- $1.50
- 컨텍스트
- 모델별 상이
- 캐시 지원
- —
- 비고
- 오픈웨이트·멀티모달
- Mistral Medium 3.5
- 공급사
- Mistral
- Input ($/1M)
- $1.50
- Output ($/1M)
- $7.50
- 컨텍스트
- 모델별 상이
- 캐시 지원
- ○
- 비고
- 상용 균형형
- Mistral Small 4
- 공급사
- Mistral
- Input ($/1M)
- $0.15
- Output ($/1M)
- $0.60
- 컨텍스트
- 모델별 상이
- 캐시 지원
- —
- 비고
- 경량·고속
- DeepSeek V4 Flash
- 공급사
- DeepSeek
- Input ($/1M)
- $0.435
- Output ($/1M)
- $0.87
- 컨텍스트
- 모델별 상이
- 캐시 지원
- ○
- 비고
- 저가 추론·에이전트
- DeepSeek V3
- 공급사
- DeepSeek
- Input ($/1M)
- $0.27
- Output ($/1M)
- $1.10
- 컨텍스트
- 128K
- 캐시 지원
- ○
- 비고
- 고성능·초저가
- DeepSeek R1
- 공급사
- DeepSeek
- Input ($/1M)
- $0.55
- Output ($/1M)
- $2.19
- 컨텍스트
- 128K
- 캐시 지원
- ○
- 비고
- 추론 특화
- Sonar
- 공급사
- Perplexity
- Input ($/1M)
- $1.00
- Output ($/1M)
- $1.00
- 컨텍스트
- 검색 context별
- 캐시 지원
- —
- 비고
- 검색 request fee 별도
- Sonar Pro
- 공급사
- Perplexity
- Input ($/1M)
- $3.00
- Output ($/1M)
- $15.00
- 컨텍스트
- 검색 context별
- 캐시 지원
- —
- 비고
- 검색 request fee 별도
- Sonar Reasoning Pro
- 공급사
- Perplexity
- Input ($/1M)
- $2.00
- Output ($/1M)
- $8.00
- 컨텍스트
- 검색 context별
- 캐시 지원
- —
- 비고
- 검색 request fee 별도
- Command A
- 공급사
- Cohere
- Input ($/1M)
- $2.50
- Output ($/1M)
- $10.00
- 컨텍스트
- 256K
- 캐시 지원
- —
- 비고
- 기업용 에이전트
설명
본 도표는 2026년 7월 14일 기준 주요 LLM API의 공식 공시 가격을 한 표에 정리한 자료입니다. 가격은 OpenAI, Anthropic, Google, xAI, Mistral, DeepSeek, Perplexity, Cohere의 공식 가격 페이지를 기준으로 했습니다.
Input 가격이 Output 가격보다 훨씬 낮은 것은 LLM이 생성하는 토큰이 입력 처리보다 연산 비용이 크기 때문입니다. 일반적으로 Output이 Input의 4~5배 비싸므로, 출력 길이를 적정 수준으로 제한하는 것이 비용 절감의 1순위입니다.
OpenAI는 GPT-5.6 Sol·Terra·Luna처럼 같은 세대 안에서 성능과 비용을 나누고, Anthropic은 Claude Fable 5·Opus 4.8·Sonnet 5·Haiku 4.5로 라인업을 구분합니다. Google은 Gemini 3.5 Flash와 Gemini 3.1 Pro/Flash-Lite를 함께 제공하고, xAI Grok 4.5와 Mistral 3 계열도 비용 비교 대상에 들어왔습니다.
프롬프트 캐시(Prompt Caching)는 동일 시스템 프롬프트·문서를 반복 사용할 때 input 비용을 줄이는 기능입니다. 다만 공급사마다 cache read, cache write, storage, long context, priority, batch 과금 방식이 다르므로 실제 견적은 콘솔 청구 화면에서 다시 확인해야 합니다.
Perplexity Sonar 계열은 토큰 비용 외에 검색 context별 request fee가 붙을 수 있습니다. Google Gemini의 Grounding with Google Search, OpenAI Web search, xAI 서버사이드 도구 호출도 토큰 외 과금이 붙을 수 있어 검색·에이전트형 서비스는 단순 토큰 비용보다 더 넓게 봐야 합니다.
한국어는 영어 대비 토큰 수가 약 2~3배 많아 동일 분량 텍스트라도 한국어 비용이 더 비쌉니다. 토큰 측정은 OpenAI tiktoken, Anthropic Tokenizer, Google Gemini Tokenizer로 사전 검증할 수 있습니다.
이 표를 읽을 때 같이 볼 것
직접 금액이나 수치를 바꿔 보려면 LLM API 비용 계산기 — Claude·GPT·Gemini 토큰 단가로 월 비용로 이어서 확인하는 편이 가장 빠릅니다.
공식 확인 경로
이 페이지는 빠르게 이해하기 좋게 정리한 요약본입니다. 실제 신청, 신고, 계약, 예약, 제출 단계에서는 아래 원문 안내를 함께 확인하는 편이 안전합니다.
- MDN Web Docs — HTML·URL·인코딩·웹 표준 참고
- RFC Editor — JWT·URI·JSON 관련 표준 원문
- Cloudflare Docs — 배포·엣지·DNS 공식 문서
자주 묻는 질문
- LLM API 가격 비교표에서 먼저 볼 항목은 무엇인가요?
- LLM API 가격 비교표은 기준일, 적용 조건, 예외 구간을 먼저 본 뒤 세부 수치를 비교하는 편이 좋습니다. 경계 구간에 있으면 연결된 계산기나 공식 안내로 한 번 더 확인하세요.
- 최신 모델이 항상 비용 대비 좋은가요?
- 아닙니다. 어려운 추론·코딩은 최신 상위 모델이 재시도를 줄여 더 쌀 수 있지만, 분류·요약·추출은 경량 모델이 훨씬 경제적입니다. 실제 서비스는 모델 라우팅으로 섞어 쓰는 방식이 보통 유리합니다.
- 이 표의 가격만으로 월 비용을 계산해도 되나요?
- 기본 토큰 비용을 보는 데는 충분하지만 최종 견적은 아닙니다. 긴 컨텍스트, Batch, Priority, 검색 grounding, tool call, cache storage, 지역 처리 가산 요금이 붙을 수 있습니다.
- 한국어 서비스는 왜 비용이 더 높게 잡히나요?
- 한국어는 같은 의미의 문장도 영어보다 토큰 수가 더 많이 나오는 경우가 많습니다. 실제 운영 전에는 서비스에서 쓰는 한국어 샘플로 input·output 평균 토큰을 직접 재야 합니다.
이 표로 더 확인하기
표에서 본 기준을 직접 계산하거나, 관련 해설과 비슷한 표로 이어서 확인하세요.