AI 토큰은 요금이 매겨지는 단위입니다. 글자 수도 단어 수도 아니고, 모델이 글을 잘라 세는 조각입니다. 요금은 이 조각의 개수로 계산되고, 한국어는 같은 내용을 영어로 쓸 때보다 토큰을 두 배 넘게 씁니다.
이 글은 2026년 8월 7일 Anthropic 공식 가격 문서에서 직접 확인한 값으로만 적었습니다. 가격은 바뀌므로 결제 전에는 공식 페이지를 한 번 더 보세요.
작성자 — 지피터스에서 마케팅을 하고 있습니다. AI 도구를 업무에 붙이면서 나온 요금을 직접 보고 정리했습니다.
이 글은 "돈이 어떻게 계산되나"에 집중합니다. 구독 플랜 한도에 안 걸리게 쓰는 실전 요령이 필요하시면 Claude Code 토큰 절약하는 10가지 방법을 보세요.
토큰이 정확히 뭔가요?
모델이 글을 처리할 때 쓰는 최소 조각입니다.
공식 문서는 영어 기준으로 1토큰이 대략 4글자, 또는 0.75단어라고 안내합니다. hello는 1토큰이지만 긴 단어는 여러 조각으로 쪼개집니다.
중요한 건 글자 수와 토큰 수가 비례하지 않는다는 점입니다. 같은 100글자라도 흔한 단어로 채우면 토큰이 적고, 특수문자나 코드가 섞이면 훨씬 많아집니다.
한국어는 얼마나 더 쓰나요?
영어보다 평 균 2.36배 더 씁니다. 언어별 토큰 효율을 비교한 분석 자료에 따른 수치이고, 같은 자료에서 일본어는 2.12배, 중국어는 1.76배입니다.
이유는 구조적입니다. 한글은 UTF-8로 저장할 때 한 글자가 3바이트를 차지하는데, 모델의 토크나이저가 영어 중심으로 만들어져 있어 한글을 통째로 인식하지 못하고 바이트 단위로 잘라 씁니다.
실무에서 뜻하는 바는 이겁니다. 같은 내용을 영어로 물으면 한국어로 물을 때보다 요금이 덜 나옵니다. 다만 한국어로 답을 받아야 한다면 결국 출력에서 다시 배수가 붙으니, 언어를 바꾸는 것보다 아래의 구조적인 방법이 효과가 큽니다.
왜 대화가 길어질수록 비싸지나요?
모델은 이전 대화를 기억하지 않기 때문입니다. 매번 새로 읽습니다.
이게 핵심인데 잘 안 알려져 있습니다. 우리 눈에는 대화가 이어지는 것처럼 보이지만, 실제로는 매 질문마다 그때까지의 대화 전체가 처음부터 다시 입력됩니다.
한국어 한국어 한국어 한국어 한국어 한국어 한국어 한국어
대화가 이어질수록 매번 앞의 전체가 다시 실려 갑니다. 질문과 답의 길이가 비슷하다고 놓고 계산하면 10번째 질문은 첫 질문의 19배를 보내는 셈입니다.
그래서 턴이 하나 늘 때마다 그 한 번의 비용도 같이 커집니다. 대화 30번을 주고받았다면 첫 질문 30번어치가 아니라, 그보다 훨씬 많은 입력을 낸 셈입니다.
대화가 길어졌다 싶으면 새 대화를 여는 게 가장 확실 한 절약입니다. 앞의 맥락이 정말 필요한 게 아니라면요.
모델별 가격이 얼마나 다른가요?
100만 토큰(MTok)당 미국 달러 기준입니다. 2026년 8월 7일 공식 문서 값입니다.
- Claude Haiku 4.5 — 입력 $1 · 출력 $5
- Claude Sonnet 5 — 입력 $2 · 출력 $10 (2026년 8월 31일까지 도입가, 9월 1일부터 $3 · $15)
- Claude Opus 5 — 입력 $5 · 출력 $25
- Claude Fable 5 — 입력 $10 · 출력 $50
가장 싼 모델과 가장 비싼 모델이 10배 차이입니다. 요약이나 분류처럼 단순한 일에 최상위 모델을 쓰면 그대로 10배를 냅니다.
한 가지 더 짚어둘 게 있습니다. Sonnet 5는 8월 31일까지만 도입가입니다. 9월 1일부터 입력이 $2에서 $3으로, 출력이 $10에서 $15로 오릅니다. 예산을 잡고 계시면 이 날짜를 넣어두세요.
입력과 출력 중 뭐가 더 비싼가요?
출력이 입력의 5배입니다. 위 표의 모든 모델에서 예외 없이 그렇습니다.
- Haiku 4.5 — 입력 $1 · 출력 $5 · 배수 5배
- Sonnet 5 — 입력 $2 · 출력 $10 · 배수 5배
- Opus 5 — 입력 $5 · 출력 $25 · 배수 5배
- Fable 5 — 입력 $10 · 출력 $50 · 배수 5배
그래서 "길게 물어보는 것"보다 "길게 답하게 하는 것"이 훨씬 비쌉니다. 긴 문서를 붙여넣는 건 생각보다 부담이 적고, 반대로 "자세히 다 써줘"는 요금이 바로 붙습니다.
답변 길이를 지정하는 것만으로 눈에 띄게 줄어듭니다. "세 문장으로", "표로만" 같은 식으로요.
실제로 얼마쯤 나오나요?
공식 문서에 있는 계산 예시입니다. Opus 5로 입력 5만 토큰, 출력 1만 5천 토큰을 쓴 경우입니다.
- 입력 50,000 × $5 ÷ 1,000,000 = $0.25
- 출력 15,000 × $25 ÷ 1,000,000 = $0.375
- 합계 $0.625
토큰만 놓고 보면 입력이 5만인데도 출력 1만 5천이 더 비쌉니다. 앞서 말한 5배 차이가 실제로 이렇게 나타납니다.
여기에 더해, 에이전트를 세션으로 돌리는 방식(Claude Managed Agents)에서는 세션 유지 시간에 시간당 $0.08이 따로 붙습니다. 위 작업을 한 시간짜리 세션으로 돌렸다면 합계가 $0.705가 됩니다. 일반 API 호출에는 이 항목이 없습니다.
같은 작업에서 입력 5만 중 4만이 캐시에서 읽힌 경우는 $0.525로 떨어집니다.
캐시와 배치는 얼마나 아껴주나요?
둘 다 공식 기능이고 할인율이 정해져 있습니다.
- 프롬프트 캐싱 — 같은 내용을 다시 읽을 때 입력 가격의 10%만 냅니다. 처음 저장할 때 1.25배(5분 유지) 또는 2배(1시간 유지)를 내고, 이후 읽기가 싸집니다. 5분짜리는 한 번만 재사용해도 이득입니다.
- 배치 처리 — 급하지 않은 작업을 모아 비동기로 돌리면 입력·출력 둘 다 50% 할인입니다.
- 두 할인은 겹쳐 적용됩니다.
긴 지시문이나 참고 문서를 매번 똑같이 넣는 작업이라면 캐싱이 가장 크게 듣습니다. 반대로 매번 내용이 달라지는 작업에는 효과가 없습니다.
모델을 바꾸면 토큰 수가 달라지나요?
달라집니다. 이게 최근에 생긴 함정입니다.
공식 문서에 이렇게 적혀 있습니다 — Claude 4.7 이후 모델은 새 토크나이저를 쓰는데, 같은 글에서 토큰이 약 30% 더 나옵니다. 성능을 위한 변경이고, 4.6 이전 모델은 기존 토크나이저를 씁니다.
즉 단가가 같아도 청구액이 오를 수 있습니다. 모델을 올린 뒤 "가격표는 그대로인데 왜 더 나오지" 싶으면 여기일 가능성이 큽니다. 늘어나는 정도는 글의 성격에 따라 다릅니다.
구독 요금제랑은 뭐가 다른가요?
과금 방식이 아예 다릅니다.
- 구독(Pro·Max 등) — 월 정액. 대신 사용량 한도가 있고, 많이 쓰면 한도에 걸립니다. 토큰당 요금이 따로 붙지 않습니다.
- API — 정액이 없고 쓴 만큼 냅니다. 한도는 없지만 청구액이 사용량에 정비례합니다.
개인이 채팅으로 쓰면 구독, 자동화를 돌리면 API가 보통 맞습니다. 이 글의 단가표는 API 기준입니다.
구독 한도에 자주 걸리시는 경우라면 Claude Code 토큰 절약하는 10가지 방법이 더 직접적입니다.
자주 나오는 질문
토큰 수를 미리 알 수 있나요?
정확히는 실행해봐야 알지만, 한국어 기준으로 글자 수의 두세 배를 잡으면 대략 맞습니다. 코드나 표가 많으면 더 나옵니다.
긴 문서를 넣으면 많이 비싸지나요?
생각보다 덜합니다. 문서는 입력이고 입력은 출력의 5분의 1이라서요. 진짜 비싼 건 그 문서를 놓고 길게 답하게 하는 쪽입니다.
컨텍스트를 100만 토큰까지 늘리면 더 비싼가요?
단가는 같습니다. 공식 문서에 90만 토큰 요청도 9천 토큰 요청과 같은 단가로 계산된다고 적혀 있습니다. 다만 넣은 만큼 토큰이 늘어나니 총액은 당연히 커집니다.
웹 검색을 켜면 따로 돈이 붙나요?
붙습니다. 검색 1,000회당 $10이고, 검색 결과로 들어온 내용은 입력 토큰으로 또 계산됩니다.
요금을 가장 빨리 줄이는 방법 하나만 고르면요?
모델을 낮추는 것입니다. Haiku와 Fable이 10배 차이라, 단순 작업을 아래 모델로 내리는 게 다른 어떤 요령보다 효과가 큽니다.
정리하며
토큰 요금은 세 가지만 알면 대부분 설명됩니다.
- 출력이 입력의 5배 — 길게 묻기보다 길게 답하게 하는 게 비쌉니다
- 대화는 매번 처음부터 다시 읽힙니다 — 길어지면 새로 여는 게 절약입니다
- 모델 간 10배 차이 — 작업 난이도에 맞춰 내리는 게 가장 큰 절감입니다
지피터스에서는 AI 도구를 실제로 굴리면서 나온 비용 얘기를 서로 공유합니다. 자동화를 붙였다가 예상보다 많이 나온 경험, 반대로 확 줄인 방법 같은 것들이요.
확인일: 2026년 8월 7일
출처: Anthropic 공식 가격 문서 · 언어별 토큰 비교는 CJK 언어 처리 분석
단가와 도입가 적용 기간은 바뀝니다. 특히 Sonnet 5 도입가는 2026년 8월 31일까지입니다. 예산을 잡으실 때는 공식 페이지에서 한 번 더 확인하세요. 한국어 토큰 배수는 공식 수치가 아니라 외부 분석값이라 콘텐츠 성격에 따라 달라질 수 있습니다.