본문으로 건너뛰기
툴허브

LLM 토큰 계산기

Claude·GPT·Gemini·DeepSeek 공식 단가로 토큰 수와 일·월 API 비용, 프롬프트 캐싱 절감액을 계산합니다.

입력 토큰 기준
처리 방식

Claude Sonnet 5.5 월 예상 비용

₩311,379

$229.80 · 월 30일 · 하루 1,000건

하루

₩10,379

요청 1건

$0.0077

캐싱 절감/월

₩54,471

텍스트 입력

0
글자 수
0
단어 수
0
줄 수
0
한글
0
영문·숫자
0
기타

컨텍스트 적합성

Claude Sonnet 5.5 · 컨텍스트 1M

2,500 / 1,000,000 토큰 (0.3%)

들어감

프롬프트 캐싱 절감액

캐싱 없음 (월)₩365,850
캐싱 적용 (월)₩311,379
월 절감액₩54,471 (14.9%)
일반 입력
₩81,300
캐시 읽기
₩6,504
캐시 쓰기
₩20,325
출력
₩203,250

모델별 월 비용 비교 (저렴한 순)

모델명입력 토큰요청당하루월 (USD)월 (원)컨텍스트
GPT-6 LunaOpenAI2,000$0.0004$0.3830$11.49₩15,569들어감
DeepSeek V4.1 FlashDeepSeek2,000$0.0010$0.9648$28.94₩39,219들어감
Gemini 3.5 Flash-LiteGoogle2,000$0.0016$1.63$49.02₩66,422들어감
Gemini 3.8 FlashGoogle2,000$0.0028$2.83$85.05₩115,243들어감
DeepSeek V4 ProDeepSeek2,000$0.0036$3.60$107.98₩146,307들어감
Claude Haiku 4.5Anthropic2,000$0.0038$3.83$114.90₩155,690들어감
Gemini 3.5 FlashGoogle2,000$0.0064$6.42$192.60₩260,973들어감
GPT-6.1 SolOpenAI2,000$0.0076$7.58$227.40₩308,127들어감
Claude Sonnet 5.5Anthropic2,000$0.0077$7.66$229.80₩311,379들어감
Gemini 3.1 ProGoogle2,000$0.0086$8.56$256.80₩347,964들어감
Claude Opus 5.5Anthropic2,000$0.0152$15.16$454.80₩616,254들어감
Claude Fable 5.1Anthropic2,000$0.0377$37.70$1,131₩1,532,505들어감
GPT-6 AstraOpenAI2,000$0.0383$38.30$1,149₩1,556,895들어감

모델 단가표 (USD / 1M 토큰)

각 사 공식 요금표에서 기준일에 확인한 값입니다. 세금, 데이터 레지던시 할증, 도구 호출 요금은 빠져 있습니다.

모델명컨텍스트입력 단가캐시 읽기캐시 쓰기출력 단가배치 입력/출력비고
Claude Fable 5.11M$10$0.25$12.5$50$5 / $25
Claude Opus 5.51M$4$0.2$5$20$2 / $10
Claude Sonnet 5.51M$2$0.2$2.5$10$1 / $5
Claude Haiku 4.5200K$1$0.1$1.25$5$0.5 / $2.5

캐시 쓰기는 5분 캐시 기준(1시간 캐시는 입력가 2배). 4.7 이후 모델은 새 토크나이저라 같은 글도 내용에 따라 최대 약 35%(1~1.35배) 더 많은 토큰이 나옵니다.

모델명컨텍스트입력 단가캐시 읽기캐시 쓰기출력 단가배치 입력/출력비고
GPT-6 Astra1.05M$10$1$12.5$50$5 / $25입력 272K 초과 시 $20/$75
GPT-6.1 Sol1.05M$2$0.1$2.5$10$1 / $5입력 272K 초과 시 $4/$15
GPT-6 Luna1.05M$0.1$0.01$0.125$0.5$0.05 / $0.25입력 272K 초과 시 $0.2/$0.75

입력이 272K 토큰을 넘으면 요청 전체에 장문 단가가 적용됩니다. 최대 입력 922K.

모델명컨텍스트입력 단가캐시 읽기캐시 쓰기출력 단가배치 입력/출력비고
Gemini 3.8 Flash1.05M$0.75$0.075—$3.75$0.375 / $1.8752026-12-31까지 프로모션가
Gemini 3.5 Flash1.05M$1.5$0.15—$9$0.75 / $4.5
Gemini 3.5 Flash-Lite1.05M$0.3$0.03—$2.5$0.15 / $1.25
Gemini 3.1 Pro1.05M$2$0.2—$12$1 / $6입력 200K 초과 시 $4/$18 · 프리뷰

유료 Standard 단가. 명시적 캐시는 시간당 저장료가 따로 붙습니다.

모델명컨텍스트입력 단가캐시 읽기캐시 쓰기출력 단가배치 입력/출력비고
DeepSeek V4.1 Flash1M$0.3$0.006—$1.2배치 없음
DeepSeek V4 Pro1M$1.32$0.044—$3.96배치 없음

피크 시간 단가 기준이며 비피크 시간은 50%입니다. 배치 API는 없습니다.

사용 가이드

토큰이란?

  • LLM이 글을 나눠 처리하는 단위로, 요금도 토큰 단위로 매겨집니다
  • 영어는 대략 4글자가 1토큰입니다
  • 같은 글도 토크나이저가 다르면 토큰 수가 달라집니다
  • 정확한 값은 각 사 토큰 카운트 API나 응답의 usage 필드로 확인하세요

한국어 토큰 특성

  • 한글은 글자당 약 0.5~1.7토큰(토크나이저마다 다름)으로 영어보다 토큰이 많이 나옵니다
  • 토크나이저마다 한글 효율 차이가 커서 같은 글도 모델별 토큰 수가 다릅니다
  • Claude 4.7 이후 모델은 새 토크나이저로 같은 글이 이전보다 최대 약 35%(1~1.35배) 더 나옵니다(Anthropic 문서)
  • 비용이 중요하면 실제 프롬프트로 토큰을 세어 '직접 입력'에 넣으세요

비용 절약 팁

  • 고정 시스템 프롬프트·문서를 앞에 두고 프롬프트 캐싱을 쓰면 입력 비용이 크게 줄어듭니다
  • 급하지 않은 작업은 배치 API로 입력·출력 50% 할인을 받습니다(배치 API가 없는 DeepSeek 제외)
  • 출력 단가가 입력보다 3~8배(대부분 5배 안팎) 비싸므로 max_tokens로 응답 길이를 제한하세요
  • OpenAI는 입력 272K, Gemini 3.1 Pro는 200K를 넘으면 장문 단가가 붙습니다

자주 묻는 질문

토큰 수가 정확한가요?

문자 종류별 비율로 계산한 추정치입니다. 특히 한글은 오차가 커서 범위로 보여 줍니다. 정확한 값은 각 사 토큰 카운트 API로 확인해 '직접 입력'에 넣으세요.

캐시 적중률은 어떻게 정하나요?

같은 앞부분으로 캐시 유지 시간(Anthropic 기본 5분) 안에 요청이 계속 오면 대부분 적중합니다. 요청이 드물면 적중률을 낮게 잡으세요. 적중하지 못한 요청은 캐시 쓰기 요금으로 계산합니다.

가격은 언제 기준인가요?

각 사 공식 요금표를 단가표에 적힌 기준일에 확인한 값입니다. 요금은 수시로 바뀌므로 결제 전 링크된 공식 페이지를 다시 확인하세요.