LLM API 비용 계산기 — Claude·GPT·Gemini 토큰 단가로 월 비용
최신 GPT-5.6·Claude 5·Gemini 3.x·Grok·Mistral·DeepSeek 모델의 input·output 토큰 단가로 일·월·연 API 비용을 환산합니다.
활용 팁
LLM API 비용 계산기은(는) 결과값 하나를 보는 도구라기보다 입력 형식과 출력 규칙을 빠르게 검증하는 실무 유틸에 가깝습니다. 복붙 직전에 한 번 더 확인해 두면 문서 공유, 배포, 디버깅 시간을 줄이는 데 도움이 됩니다.
- 원본 텍스트의 줄바꿈, 인코딩, 따옴표 같은 형식 요소를 먼저 확인하세요.
- 출력 결과는 미리보기와 원문을 번갈아 보면서 구조가 깨지지 않는지 확인하세요.
- 민감한 토큰·키·개인정보는 테스트 입력에서도 제외하는 편이 안전합니다.
- 결과는 신고·정산·계약 전에 AI 에이전트 업무 자동화 2026 — 직장인 실전 도입 가이드와 함께 확인하면 더 정확합니다.
- 2026 LLM API 가격 비교표 — GPT-5.6·Claude 5·Gemini 3.x 토큰 단가같은 도표를 같이 보면 해석이 훨씬 쉬워집니다.
입력
입력값과 이력은 이 브라우저에만 저장되며 서버로 전송되지 않습니다.
반복 프롬프트 캐시 적용 비율. 실제 캐시 단가와 저장 비용은 공급사별로 다릅니다.
결과
- 월 예상 비용
- 25,875원
- 월 USD
- $18.75
- 1회 호출 단가
- $0.00625
- 선택 모델
- GPT-5.6 Terra (OpenAI)
- 1회 입력 비용
- $0.00250
- 1회 출력 비용
- $0.00375
- 1일 비용 (USD / KRW)
- $0.63 · 863원
- 1월 비용 (USD / KRW)
- $18.75 · 25,875원
- 1년 비용 (USD / KRW)
- $228.13 · 314,813원
- == 캐시 절감 효과 ==
- 캐시 적용률
- 0%
- 캐시 미적용 대비 월 절감
- 0% (캐시 없음)
- · 가격은 2026년 7월 14일 공식 가격표 기준입니다. 장문 컨텍스트, Priority, Batch, 검색·도구 호출료는 별도 과금될 수 있습니다.
- · 프롬프트 캐시는 동일 시스템 프롬프트 반복 시 input 비용을 크게 줄일 수 있지만, 공급사별 cache read/write·storage 단가가 다릅니다.
- · 한국어 토큰은 영어 대비 약 2~3배 많아 토큰 수에 차이가 있을 수 있습니다.
계산 후 바로 할 일
결과 저장 전에 이어서 확인신뢰 기준
본 계산기는 2026년 7월 14일 공식 가격표 기준의 토큰 비용 시뮬레이션입니다. 실제 청구는 공급사 콘솔(OpenAI Platform·Claude Console·Google AI Studio·xAI Console 등)에서 확인하세요. 가격, 지역 가산, 긴 컨텍스트, 검색·도구 호출료는 수시로 변경될 수 있습니다.
- 업데이트
- 2026-07-14
- 비용
- 무료·회원가입 없음
- 저장
- 브라우저 내 저장
- OpenAI API Pricing· OpenAI
- Claude models overview and pricing· Anthropic
- Gemini Developer API pricing· Google AI
- xAI API pricing· xAI
외부 사이트에 임베드 (iframe 코드 복사)
블로그·기업 사이트에 이 계산기를 그대로 넣으세요. 무료, 회원가입 없음. 광고·헤더·푸터 없는 클린 UI 임베드.
<iframe
src="https://thorkit.kr/embed/llm-api-cost/"
width="100%"
height="900"
frameborder="0"
style="border: 1px solid #e5e7eb; border-radius: 6px;"
title="LLM API 비용 계산기 — Claude·GPT·Gemini 토큰 단가로 월 비용 — ThorKit"
loading="lazy"
></iframe>
<script>
window.addEventListener("message", function(e) {
if (e.origin !== "https://thorkit.kr") return;
if (e.data && e.data.type === "thorkit:height") {
var iframes = document.querySelectorAll('iframe[src*="https://thorkit.kr/embed/"]');
iframes.forEach(function(f) { f.style.height = e.data.height + "px"; });
}
});
</script>계산 근거
LLM API 비용 계산기는 GPT-5.6, Claude 5, Gemini 3.x, Grok, Mistral, DeepSeek, Perplexity Sonar, Cohere Command A처럼 실제 서비스에서 자주 비교하는 모델의 input·output 토큰 단가를 적용해 일·월·연 API 비용을 환산하는 개발자용 도구입니다.
2026년 7월 기준 모델 가격은 공급사별 전략이 크게 갈립니다. OpenAI는 GPT-5.6 Sol·Terra·Luna처럼 성능대별 라인업이 세분화됐고, Anthropic은 Claude Fable 5·Opus 4.8·Sonnet 5·Haiku 4.5로 구분됩니다. Google은 Gemini 3.5 Flash와 Gemini 3.1 Pro/Flash-Lite를 같이 운영하며, xAI·Mistral·DeepSeek도 비용 비교 대상에 들어왔습니다.
토큰 단가는 입력보다 출력이 비싼 구조입니다. 긴 시스템 프롬프트보다 긴 답변, 코드 생성, 리포트 생성, 에이전트 반복 실행이 비용을 빠르게 키웁니다. 같은 일 1,000회 호출이라도 출력 토큰을 500개에서 2,000개로 늘리면 월 비용이 몇 배로 달라집니다.
프롬프트 캐시는 운영 비용을 크게 줄이는 기능입니다. 시스템 프롬프트, 정책 문서, RAG 기준 문서처럼 반복되는 input 부분을 캐시하면 input 비용을 낮출 수 있습니다. 다만 OpenAI의 cache write, Google의 cache storage, Perplexity의 검색 request fee처럼 토큰 외 과금이 붙는 경우가 있어 최종 청구 전에는 공급사 콘솔을 확인해야 합니다.
한국어는 영어 대비 토큰 수가 약 2~3배 많습니다. 같은 분량 텍스트라도 한국어 서비스 비용은 영어보다 비싸므로, 예상 토큰 수 계측을 영어 기준이 아닌 한국어 기준으로 잡아야 합니다.
결과 해석 포인트
개발형 유틸은 정답을 대신 내기보다 실수를 빨리 잡아 주는 도구에 가깝습니다. 결과를 바로 배포나 제출에 쓰기보다 관련 포맷 가이드와 표준 문서를 같이 보는 편이 안정적입니다.
공식 확인 경로
이 페이지는 빠르게 이해하기 좋게 정리한 요약본입니다. 실제 신청, 신고, 계약, 예약, 제출 단계에서는 아래 원문 안내를 함께 확인하는 편이 안전합니다.
- MDN Web Docs — HTML·URL·인코딩·웹 표준 참고
- RFC Editor — JWT·URI·JSON 관련 표준 원문
- Cloudflare Docs — 배포·엣지·DNS 공식 문서
활용 예시
고객 응대 챗봇 (Sonnet, 일 1,000회)
input 3,000 + output 500 토큰, 일 1,000회라면 Claude Sonnet 5 intro 기준 월 약 $330 전후입니다. 고정 정책 문서가 길면 캐시 적용 여부가 월 비용을 크게 바꿉니다.
RAG 문서 검색 (Haiku, 일 5,000회)
input 8,000 + output 300 토큰, 일 5,000회라면 Haiku 4.5나 Gemini 3.1 Flash-Lite 같은 경량 모델부터 비교하는 편이 좋습니다. 검색 품질이 중요하면 Sonar Pro처럼 검색 비용이 붙는 모델은 request fee까지 별도 계산해야 합니다.
코드 어시스턴트 (GPT-5.6 Terra, 일 100회)
input 5,000 + output 1,500 토큰, 일 100회라면 GPT-5.6 Terra 기준 월 약 $168 전후입니다. 복잡한 디버깅만 Sol·Fable·Opus로 올리고 일반 수정은 Terra·Luna·Codex 모델로 라우팅하면 비용을 줄일 수 있습니다.
자주 묻는 질문
- LLM API 비용은 input과 output 중 무엇이 더 중요하나요?
- 대부분의 모델은 output 단가가 input보다 몇 배 비쌉니다. 챗봇은 답변 길이, 코드 생성기는 생성 코드 길이, 리포트 자동화는 최종 문서 길이가 월 비용을 크게 좌우합니다.
- GPT-5.6, Claude 5, Gemini 3.x 중 어떤 모델이 가장 싸나요?
- 단순 토큰 단가만 보면 경량 모델이 유리하지만 실제 비용은 작업 성공률과 재시도 횟수까지 봐야 합니다. 초안·분류·요약은 저가 모델, 복잡한 추론·코딩·장문 의사결정은 상위 모델로 라우팅하는 방식이 보통 더 경제적입니다.
- 프롬프트 캐시 비율은 어떻게 잡아야 하나요?
- 시스템 프롬프트와 고정 문서가 거의 매번 반복되면 50~80%로 잡아 볼 수 있습니다. 사용자 입력이 대부분이고 고정 컨텍스트가 짧다면 0~20%가 현실적입니다. 실제 cache read/write 단가는 공급사 콘솔에서 다시 확인해야 합니다.
- Perplexity Sonar처럼 검색이 붙은 모델도 이 계산만 보면 되나요?
- 아니요. Sonar 계열은 토큰 비용 외에 검색 context별 request fee나 citation·reasoning token 비용이 붙을 수 있습니다. 이 계산기는 기본 토큰 비용을 보는 용도이고, 검색 호출료는 별도로 더해야 합니다.
⚠ 본 계산기는 2026년 7월 14일 공식 가격표 기준의 토큰 비용 시뮬레이션입니다. 실제 청구는 공급사 콘솔(OpenAI Platform·Claude Console·Google AI Studio·xAI Console 등)에서 확인하세요. 가격, 지역 가산, 긴 컨텍스트, 검색·도구 호출료는 수시로 변경될 수 있습니다.
다음으로 해볼 것
계산 결과를 해석하거나, 기준표를 확인하거나, 이어서 계산할 수 있는 콘텐츠입니다.
- 아티클결과 해석AI 에이전트 업무 자동화 2026 — 직장인 실전 도입 가이드
회의록·이메일·자료조사·엑셀 정리부터 시작해 개인정보·저작권·승인 절차 리스크를 피하는 AI 에이전트 도입 순서.
- 아티클결과 해석대기업·유니콘 개발자 채용 2026 — 네카라쿠배당토·AI 엔지니어 준비
네이버, 카카오, 라인, 쿠팡, 배민, 당근, 토스, 야놀자 같은 대기업·유니콘 개발자 채용을 준비할 때 이력서, 포트폴리오, 과제, AI 활용 역량을 어떻게 보여줄지 정리했습니다.
- 아티클결과 해석AI 구독료 다이어트 2026 — ChatGPT·Claude·Gemini 중복 구독 줄이는 법
AI 도구를 여러 개 쓰며 월 구독료가 쌓이는 직장인·프리랜서를 위한 구독 정리 기준과 업무별 추천 조합.
- 도표기준 확인2026 LLM API 가격 비교표 — GPT-5.6·Claude 5·Gemini 3.x 토큰 단가
OpenAI·Anthropic·Google·xAI·Mistral·DeepSeek·Perplexity·Cohere 주요 모델의 input·output 토큰 단가와 주의할 과금 항목을 한 표로 정리.
- 계산기다음 계산JSON ↔ YAML ↔ XML 변환
JSON·YAML·XML 사이를 양방향 변환합니다. 6가지 조합 모두 지원.
</> 이 계산기를 다른 사이트에 임베드하기
아래 코드를 블로그·뉴스·기업 사이트의 HTML 영역에 붙여넣으면 이 계산기를 그대로 사용할 수 있습니다. 무료, 별도 신청 X.
<iframe src="https://thorkit.kr/embed/llm-api-cost/" width="100%" height="900" frameborder="0" style="border: 1px solid #e5e7eb;" title="LLM API 비용 계산기 — Claude·GPT·Gemini 토큰 단가로 월 비용 — ThorKit(토르킷)" loading="lazy" ></iframe>