claude api 토큰 요금 Claude API 토큰 요금은 선택한 모델과 입력·출력 토큰 비율에 따라 청구 금액이 달라집니다. 클로드 API 가격은 claude.ai 구독과 별도 상품이므로, 플랜 요금만 보고 API 사용량 비용을 예측하면 오차가 생깁니다. 토큰 단가를 알아 두면 기능별로 예산을 나누기가 수월합니다.
이 글은 2026년 8월 기준 토큰 단가와 계산식, 캐시와 배치 할인 조건을 정리합니다. 요금이 커지는 지점을 확인하고 한도를 설정하는 절차까지 순서대로 안내합니다. 입력 출력 토큰을 나눠 보면 같은 대화라도 모델마다 금액 차이가 뚜렷합니다.
Claude API 토큰 요금 체계 한눈에 보기

Anthropic API는 모델별로 입력 토큰과 출력 토큰을 백만 토큰 단위로 과금합니다. 입력 단가는 대략 1달러에서 10달러, 출력 단가는 5달러에서 50달러 구간에 놓입니다. 출력 단가가 입력보다 높으므로 긴 답변은 금액이 빨리 늘어납니다. 청구 주기는 월 단위인 경우가 많아 월말에 사용량이 몰리면 예산이 빨리 소진됩니다.
API 토큰 과금과 Free, Pro, Max, Team, Enterprise 구독은 서로 다른 상품입니다. 2026년 8월 Sonnet 5 단가 결정은 구독 정액제에 영향을 주지 않습니다. 같은 기능을 여러 모델로 시험하면 품질 대비 단가 차이를 숫자로 확인할 수 있습니다.
토큰이란 무엇이며 어떻게 과금되나
토큰은 모델이 텍스트를 나누어 처리하는 과금 단위입니다. 한글은 영문보다 토큰이 더 나오는 경우가 많아 같은 글자 수라도 비용이 높아질 수 있습니다. 요청마다 입력과 출력을 따로 집계한 뒤 백만 단위 단가를 곱합니다. 공백과 문장부호도 토큰에 포함될 수 있어 원문을 불필요하게 늘리지 않는 것이 좋습니다.
콘솔이나 사용량 API에서 토큰 수를 확인할 수 있습니다. 대략치만 보고 예산을 잡으면 출력 토큰이 늘어날 때 금액이 어긋납니다. 입력에 시스템 지시와 대화 이력을 모두 넣으면 토큰이 누적됩니다. 짧은 질문도 이력이 길면 입력 과금이 먼저 커집니다.
토큰 추정기는 근사값만 제공합니다. 최종 금액은 실제 응답의 토큰 집계를 기준으로 합니다.
입력·출력 토큰 단가와 모델별 차이
(출처: 새로운 시작 (neosarchizo))
2026년 8월 기준 현행 단가는 Haiku 4.5가 입력 1달러·출력 5달러, Sonnet 5가 2달러·10달러입니다. Opus 5는 5달러·25달러, Fable 5는 10달러·50달러이며 단위는 백만 토큰입니다. 전 라인업에서 출력 단가는 입력의 다섯 배로 맞춰져 있습니다. 캐시 읽기 단가는 기본 입력가보다 낮게 책정되어 반복 호출에서 차이가 납니다.
| 모델 | 입력 (USD/MTok) | 출력 (USD/MTok) |
|---|---|---|
| Haiku 4.5 | 1 | 5 |
| Sonnet 5 | 2 | 10 |
| Opus 5 | 5 | 25 |
| Fable 5 | 10 | 50 |
Anthropic은 2026년 8월 10일에 Claude Sonnet 5 도입가 2달러·10달러를 정식가로 고정했습니다. 9월 1일 3달러·15달러 인상은 취소되었고, 공식 계정 공지도 같은 날 2달러·10달러 유지를 밝혔습니다. 이 결정은 API 사용량 과금에만 적용됩니다.
토큰 사용량 계산과 예상 비용 산출
예상 비용은 입력 토큰을 백만으로 나눈 값에 입력 단가를 곱하고, 출력 토큰을 백만으로 나눈 값에 출력 단가를 곱한 뒤 더하면 됩니다. 토큰당 단가가 필요하면 백만 토큰 가격을 1,000,000으로 나누면 됩니다. 로그의 입력·출력 수를 이 식에 넣으면 청구 예상치가 나옵니다. 소수점 이하는 월합에서 반올림되므로 소액 호출이 많으면 합계를 한 번 더 대조합니다.
예로 Sonnet 5에서 입력 10만 토큰과 출력 2만 토큰이면 입력 0.2달러, 출력 0.2달러로 합계 0.4달러입니다. 출력이 늘어나면 같은 입력에서도 금액이 크게 벌어집니다. 모델만 바꿔도 배율이 달라지니 시나리오별로 따로 계산하는 편이 안전합니다. 캐시와 배치를 쓰면 실효 단가가 달라지므로 표준가 식과 할인 식을 구분해 적습니다.
요금이 커지는 원인과 줄이는 실무 팁
금액이 커지는 흔한 원인은 긴 시스템 프롬프트, 반복되는 자료 첨부, 불필요하게 높은 출력 한도입니다. 고급 모델로 모든 요청을 보내면 단가 차이가 그대로 누적됩니다. 실시간 응답이 필요 없는 작업은 할인을 먼저 검토하는 것이 좋습니다. 할인은 조건이 맞을 때만 적용되므로 캐시 키와 배치 제출 여부를 코드에서 확인합니다.
프롬프트 캐싱은 반복 컨텍스트의 캐시 읽기를 기본 입력가의 약 10%로 낮춥니다. 캐시 기록은 기본 입력가의 125%이며, 긴 프롬프트에서는 비용을 최대 약 90%까지 줄일 수 있다고 안내됩니다. Message Batches API는 비동기 작업에 입력과 출력 모두 표준가의 50%를 적용합니다. 배치 창은 최대 약 24시간이므로 마감이 있는 보고에는 표준 요청을 유지합니다.
프롬프트 길이와 컨텍스트 최적화
고정된 지시문과 자료는 매 요청에 다시 넣지 말고 캐시에 두는 편이 낫습니다. 대화 이력이 길어지면 입력 토큰이 먼저 늘므로 오래된 턴은 요약하거나 잘라냅니다. 출력 최대 길이를 업무에 맞게 낮추면 출력 과금도 함께 줄어듭니다. 컨텍스트에 중복 문단이 있으면 입력 토큰만 늘고 품질은 거의 달라지지 않습니다.
캐시 읽기 약 90% 할인과 배치 50% 할인을 함께 쓰면 반복 입력 토큰의 실효 단가가 표준 입력가의 약 5%까지 내려갈 수 있습니다. 배치 작업은 최대 약 24시간이 걸릴 수 있고 최소 물량은 없습니다. 실시간 채팅에는 배치를 쓰지 않는 것이 맞습니다. 시스템 지시가 바뀌면 캐시를 다시 기록해야 해서 125% 요금이 한 번 발생합니다.
청구 확인, 한도 설정, 모니터링 방법
콘솔의 사용량과 청구 화면에서 모델별 입력·출력 토큰과 금액을 확인합니다. 일별·월별 합계를 보면 특정 기능이나 모델에 비용이 몰리는지 바로 드러납니다. 개발 키와 운영 키의 사용량을 나눠 보면 사고 구간을 찾기 쉽습니다. 한도 도달 시 오류 코드를 애플리케이션에서 잡아 재시도 폭주를 막습니다.
월 예산과 분당 요청 한도를 미리 걸어 두면 테스트 중 폭주를 막을 수 있습니다. 키가 여러 개면 환경별로 한도를 나누는 것이 안전합니다. 로그에 토큰 수를 남겨 두면 나중에 기능 단위 원가를 다시 계산하기 쉽습니다. 캐시 적중률과 배치 비율을 같이 보면 할인 효과가 실제로 났는지 검증할 수 있습니다.
프로젝트 태그를 붙이면 팀별 청구를 나누어 볼 수 있습니다. 월초와 월말에 한 번씩 단가표와 실제 청구를 대조하면 누락을 줄입니다.
Claude API 토큰 요금 정리와 선택 가이드
일상 대량 처리는 Haiku 4.5, 균형이 필요하면 Sonnet 5, 난이도가 높은 추론은 Opus 5나 Fable 5를 검토하면 됩니다. 입력보다 출력이 비싼 구조이므로 답변 길이를 먼저 통제하는 것이 효과적입니다. 반복 입력은 캐시를, 지연을 허용하는 작업은 배치를 적용합니다. 신규 모델이 나와도 기존 단가가 바로 바뀌지 않으니 출시 공지의 적용 시점을 확인합니다.
구독 플랜과 API 사용량 비용은 따로 예산에 올립니다. 단가가 고정된 뒤에도 토큰 수가 늘면 청구는 그대로 커지므로 한도와 알림을 함께 두는 편이 안전합니다. 모델 선택과 할인 조건을 맞추면 클로드 요금 절감 폭이 커집니다. 테스트 트래픽은 별도 키로 분리해야 운영 비용 집계가 왜곡되지 않습니다.