ThorKit

2026 LLM API 가격 비교표 — GPT-5.6·Claude 5·Gemini 3.x 토큰 단가

OpenAI·Anthropic·Google·xAI·Mistral·DeepSeek·Perplexity·Cohere 주요 모델의 input·output 토큰 단가와 주의할 과금 항목을 한 표로 정리.

마지막 업데이트: 2026-07-14

핵심 팁

LLM API 가격 비교표은(는) 포맷, 옵션, 규칙 차이를 빠르게 대조하는 개발용 표입니다. 문법을 외우기보다 어떤 상황에서 어떤 형식을 써야 하는지 정리할 때 효과적입니다.

  • 입력 형식과 출력 형식을 먼저 구분해서 보세요.
  • 테스트 데이터로 한 번 확인한 뒤 실데이터에 적용하세요.
  • 표준 문서와 같이 보면 해석 오류를 줄일 수 있습니다.
  • 관련 계산기와 해설 글을 같이 보면 실제 적용이 쉬워집니다.
  • GPT-5.6 Sol
    공급사
    OpenAI
    Input ($/1M)
    $2.50
    Output ($/1M)
    $15.00
    컨텍스트
    Short 기준
    캐시 지원
    비고
    최상위 작업·코딩·에이전트
  • GPT-5.6 Terra
    공급사
    OpenAI
    Input ($/1M)
    $1.25
    Output ($/1M)
    $7.50
    컨텍스트
    Short 기준
    캐시 지원
    비고
    균형형 기본 선택
  • GPT-5.6 Luna
    공급사
    OpenAI
    Input ($/1M)
    $0.50
    Output ($/1M)
    $3.00
    컨텍스트
    Short 기준
    캐시 지원
    비고
    저비용 대량 처리
  • GPT-5.5
    공급사
    OpenAI
    Input ($/1M)
    $2.50
    Output ($/1M)
    $15.00
    컨텍스트
    Short 기준
    캐시 지원
    비고
    고성능 범용
  • GPT-5.5 Pro
    공급사
    OpenAI
    Input ($/1M)
    $15.00
    Output ($/1M)
    $90.00
    컨텍스트
    Short 기준
    캐시 지원
    비고
    고비용 최고급
  • GPT-5.4
    공급사
    OpenAI
    Input ($/1M)
    $1.25
    Output ($/1M)
    $7.50
    컨텍스트
    Short 기준
    캐시 지원
    비고
    이전 세대 범용
  • GPT-5.4 mini
    공급사
    OpenAI
    Input ($/1M)
    $0.375
    Output ($/1M)
    $2.25
    컨텍스트
    Short 기준
    캐시 지원
    비고
    저가 범용
  • GPT-5.4 nano
    공급사
    OpenAI
    Input ($/1M)
    $0.10
    Output ($/1M)
    $0.625
    컨텍스트
    Short 기준
    캐시 지원
    비고
    초저가 분류·추출
  • GPT-5.1
    공급사
    OpenAI
    Input ($/1M)
    $1.25
    Output ($/1M)
    $10.00
    컨텍스트
    400K
    캐시 지원
    비고
    안정형 범용
  • GPT-5.3 Codex
    공급사
    OpenAI
    Input ($/1M)
    $1.75
    Output ($/1M)
    $14.00
    컨텍스트
    코딩 특화
    캐시 지원
    비고
    코드 생성·수정
  • Claude Fable 5
    공급사
    Anthropic
    Input ($/1M)
    $10.00
    Output ($/1M)
    $50.00
    컨텍스트
    200K
    캐시 지원
    ○ (~90%)
    비고
    최상위 추론
  • Claude Opus 4.8
    공급사
    Anthropic
    Input ($/1M)
    $5.00
    Output ($/1M)
    $25.00
    컨텍스트
    200K
    캐시 지원
    ○ (~90%)
    비고
    고성능 코딩·문서
  • Claude Sonnet 5 (intro)
    공급사
    Anthropic
    Input ($/1M)
    $2.00
    Output ($/1M)
    $10.00
    컨텍스트
    200K
    캐시 지원
    ○ (~90%)
    비고
    2026-08-31까지 intro
  • Claude Sonnet 5 (standard)
    공급사
    Anthropic
    Input ($/1M)
    $3.00
    Output ($/1M)
    $15.00
    컨텍스트
    200K
    캐시 지원
    ○ (~90%)
    비고
    intro 종료 후 표준가
  • Claude Haiku 4.5
    공급사
    Anthropic
    Input ($/1M)
    $1.00
    Output ($/1M)
    $5.00
    컨텍스트
    200K
    캐시 지원
    ○ (~90%)
    비고
    고속·대량 처리
  • Gemini 3.5 Flash
    공급사
    Google
    Input ($/1M)
    $1.50
    Output ($/1M)
    $9.00
    컨텍스트
    Gemini 3
    캐시 지원
    비고
    속도·검색·그라운딩
  • Gemini 3.1 Pro Preview
    공급사
    Google
    Input ($/1M)
    $2.00
    Output ($/1M)
    $12.00
    컨텍스트
    <=200K 기준
    캐시 지원
    비고
    상위 추론·멀티모달
  • Gemini 3.1 Flash-Lite
    공급사
    Google
    Input ($/1M)
    $0.25
    Output ($/1M)
    $1.50
    컨텍스트
    Gemini 3
    캐시 지원
    비고
    초저가 대량 처리
  • Gemini 3 Flash Preview
    공급사
    Google
    Input ($/1M)
    $0.50
    Output ($/1M)
    $3.00
    컨텍스트
    Gemini 3
    캐시 지원
    비고
    Flash 계열 기본
  • Gemini 2.5 Pro
    공급사
    Google
    Input ($/1M)
    $1.25
    Output ($/1M)
    $10.00
    컨텍스트
    <=200K 기준
    캐시 지원
    비고
    초장문·멀티모달
  • Gemini 2.5 Flash
    공급사
    Google
    Input ($/1M)
    $0.30
    Output ($/1M)
    $2.50
    컨텍스트
    1M
    캐시 지원
    비고
    이전 Flash 계열
  • Grok 4.5
    공급사
    xAI
    Input ($/1M)
    $2.00
    Output ($/1M)
    $6.00
    컨텍스트
    최신 stable
    캐시 지원
    비고
    코딩·에이전트·지식작업
  • Grok 4.3
    공급사
    xAI
    Input ($/1M)
    $1.25
    Output ($/1M)
    $2.50
    컨텍스트
    200K 이하 기준
    캐시 지원
    비고
    저비용 범용
  • Mistral Large 3
    공급사
    Mistral
    Input ($/1M)
    $0.50
    Output ($/1M)
    $1.50
    컨텍스트
    모델별 상이
    캐시 지원
    비고
    오픈웨이트·멀티모달
  • Mistral Medium 3.5
    공급사
    Mistral
    Input ($/1M)
    $1.50
    Output ($/1M)
    $7.50
    컨텍스트
    모델별 상이
    캐시 지원
    비고
    상용 균형형
  • Mistral Small 4
    공급사
    Mistral
    Input ($/1M)
    $0.15
    Output ($/1M)
    $0.60
    컨텍스트
    모델별 상이
    캐시 지원
    비고
    경량·고속
  • DeepSeek V4 Flash
    공급사
    DeepSeek
    Input ($/1M)
    $0.435
    Output ($/1M)
    $0.87
    컨텍스트
    모델별 상이
    캐시 지원
    비고
    저가 추론·에이전트
  • DeepSeek V3
    공급사
    DeepSeek
    Input ($/1M)
    $0.27
    Output ($/1M)
    $1.10
    컨텍스트
    128K
    캐시 지원
    비고
    고성능·초저가
  • DeepSeek R1
    공급사
    DeepSeek
    Input ($/1M)
    $0.55
    Output ($/1M)
    $2.19
    컨텍스트
    128K
    캐시 지원
    비고
    추론 특화
  • Sonar
    공급사
    Perplexity
    Input ($/1M)
    $1.00
    Output ($/1M)
    $1.00
    컨텍스트
    검색 context별
    캐시 지원
    비고
    검색 request fee 별도
  • Sonar Pro
    공급사
    Perplexity
    Input ($/1M)
    $3.00
    Output ($/1M)
    $15.00
    컨텍스트
    검색 context별
    캐시 지원
    비고
    검색 request fee 별도
  • Sonar Reasoning Pro
    공급사
    Perplexity
    Input ($/1M)
    $2.00
    Output ($/1M)
    $8.00
    컨텍스트
    검색 context별
    캐시 지원
    비고
    검색 request fee 별도
  • Command A
    공급사
    Cohere
    Input ($/1M)
    $2.50
    Output ($/1M)
    $10.00
    컨텍스트
    256K
    캐시 지원
    비고
    기업용 에이전트

설명

본 도표는 2026년 7월 14일 기준 주요 LLM API의 공식 공시 가격을 한 표에 정리한 자료입니다. 가격은 OpenAI, Anthropic, Google, xAI, Mistral, DeepSeek, Perplexity, Cohere의 공식 가격 페이지를 기준으로 했습니다.

Input 가격이 Output 가격보다 훨씬 낮은 것은 LLM이 생성하는 토큰이 입력 처리보다 연산 비용이 크기 때문입니다. 일반적으로 Output이 Input의 4~5배 비싸므로, 출력 길이를 적정 수준으로 제한하는 것이 비용 절감의 1순위입니다.

OpenAI는 GPT-5.6 Sol·Terra·Luna처럼 같은 세대 안에서 성능과 비용을 나누고, Anthropic은 Claude Fable 5·Opus 4.8·Sonnet 5·Haiku 4.5로 라인업을 구분합니다. Google은 Gemini 3.5 Flash와 Gemini 3.1 Pro/Flash-Lite를 함께 제공하고, xAI Grok 4.5와 Mistral 3 계열도 비용 비교 대상에 들어왔습니다.

프롬프트 캐시(Prompt Caching)는 동일 시스템 프롬프트·문서를 반복 사용할 때 input 비용을 줄이는 기능입니다. 다만 공급사마다 cache read, cache write, storage, long context, priority, batch 과금 방식이 다르므로 실제 견적은 콘솔 청구 화면에서 다시 확인해야 합니다.

Perplexity Sonar 계열은 토큰 비용 외에 검색 context별 request fee가 붙을 수 있습니다. Google Gemini의 Grounding with Google Search, OpenAI Web search, xAI 서버사이드 도구 호출도 토큰 외 과금이 붙을 수 있어 검색·에이전트형 서비스는 단순 토큰 비용보다 더 넓게 봐야 합니다.

한국어는 영어 대비 토큰 수가 약 2~3배 많아 동일 분량 텍스트라도 한국어 비용이 더 비쌉니다. 토큰 측정은 OpenAI tiktoken, Anthropic Tokenizer, Google Gemini Tokenizer로 사전 검증할 수 있습니다.

이 표를 읽을 때 같이 볼 것

직접 금액이나 수치를 바꿔 보려면 LLM API 비용 계산기 — Claude·GPT·Gemini 토큰 단가로 월 비용로 이어서 확인하는 편이 가장 빠릅니다.

공식 확인 경로

이 페이지는 빠르게 이해하기 좋게 정리한 요약본입니다. 실제 신청, 신고, 계약, 예약, 제출 단계에서는 아래 원문 안내를 함께 확인하는 편이 안전합니다.

자주 묻는 질문

LLM API 가격 비교표에서 먼저 볼 항목은 무엇인가요?
LLM API 가격 비교표은 기준일, 적용 조건, 예외 구간을 먼저 본 뒤 세부 수치를 비교하는 편이 좋습니다. 경계 구간에 있으면 연결된 계산기나 공식 안내로 한 번 더 확인하세요.
최신 모델이 항상 비용 대비 좋은가요?
아닙니다. 어려운 추론·코딩은 최신 상위 모델이 재시도를 줄여 더 쌀 수 있지만, 분류·요약·추출은 경량 모델이 훨씬 경제적입니다. 실제 서비스는 모델 라우팅으로 섞어 쓰는 방식이 보통 유리합니다.
이 표의 가격만으로 월 비용을 계산해도 되나요?
기본 토큰 비용을 보는 데는 충분하지만 최종 견적은 아닙니다. 긴 컨텍스트, Batch, Priority, 검색 grounding, tool call, cache storage, 지역 처리 가산 요금이 붙을 수 있습니다.
한국어 서비스는 왜 비용이 더 높게 잡히나요?
한국어는 같은 의미의 문장도 영어보다 토큰 수가 더 많이 나오는 경우가 많습니다. 실제 운영 전에는 서비스에서 쓰는 한국어 샘플로 input·output 평균 토큰을 직접 재야 합니다.

이 표로 더 확인하기

표에서 본 기준을 직접 계산하거나, 관련 해설과 비슷한 표로 이어서 확인하세요.

모든 도표 →