모델 등급별로 입력·출력 단가가 다릅니다

아래는 2026년 8월 28일 공식 가격 문서에서 현재 판매 중인 텍스트 모델의 단가를 추린 것입니다. 모두 미국 달러, 100만 토큰(MTok) 기준입니다.

모델입력출력메모
Claude Haiku 4.5$1.00$5.00분류·추출 등 대량 작업용
Claude Sonnet 5$2.00$10.00범용, 아래 가격 변동 이력 참고
Claude Sonnet 4.6$3.00$15.00이전 세대 Sonnet
Claude Opus 5$5.00$25.00복잡한 추론·에이전트용
가격 문서를 읽다 걸린 부분

Sonnet 5의 $2/$10은 출시 당시 2026년 8월 31일까지의 “한시 가격”으로 안내됐고 9월부터 $3/$15로 오를 예정이었습니다. 그런데 현재 공식 문서에는 인상 계획이 취소되고 이 가격이 표준가로 확정됐다고 명시되어 있습니다. 8월에 작성된 다른 비교 글에는 인상 예정 정보가 남아 있을 수 있으니 날짜를 확인하고 읽어야 합니다.

Anthropic 공식 문서의 Claude 모델별 가격표와 Sonnet 5 가격 확정 안내
Anthropic 공식 가격 문서의 Model pricing 표 캐시 쓰기·읽기 단가가 모델별로 함께 표시됩니다. 표 아래 파란 박스에서는 Sonnet 5의 $2/$10 가격이 표준가로 확정됐음을 안내합니다. 촬영 2026.08.28

표에 없는 최상위 모델 Fable 5($10/$50)도 있지만, 비용 구조를 처음 잡는 단계라면 Haiku·Sonnet·Opus 세 등급의 차이부터 이해하는 편이 낫습니다. 같은 작업을 어느 등급에 맡길지가 단가 몇 센트 차이보다 월 청구액을 크게 바꿉니다.

계산에 영향을 주는 조건이 하나 더 있습니다. Opus 4.7 이후 세대(Opus 5, Fable 5 포함)는 새 토크나이저를 써서 같은 텍스트가 약 30% 더 많은 토큰으로 집계됩니다. Sonnet 4.6에서 Opus 5로 갈아탈 때 단가 배수만 곱하면 실제 청구액을 과소평가하게 됩니다.

무료 티어는 없고, 신규 가입 크레딧만 있습니다

상시 무료 티어가 있는 Gemini API와는 구조가 다릅니다. 공식 FAQ 기준으로 신규 사용자에게 테스트용 소액 크레딧이 제공됩니다. 그 이후는 전액 종량제입니다. “무료로 계속 쓸 수 있는 한도”를 전제로 개인 프로젝트 예산을 잡으면 안 됩니다.

대신 결제 방식은 선불 크레딧 충전이라 카드에서 예상 밖 금액이 빠져나가는 구조는 아닙니다. 콘솔에서 크레딧을 충전하고 사용량이 차감되는 방식입니다. 소액을 충전해 실제 토큰 소모량을 먼저 측정하는 접근이 안전합니다.

하루 100회 요청이면 모델별 월 비용이 이렇게 갈립니다

가정: 하루 100회 × 30일, 요청당 입력 2,000·출력 500토큰 (월 입력 6M·출력 1.5M)Claude Haiku 4.5
입력: 6 × $1.00 = $6.00
출력: 1.5 × $5.00 = $7.50
합계: $13.50 (약 1만 9천 원)

Claude Sonnet 5
입력: 6 × $2.00 = $12.00
출력: 1.5 × $10.00 = $15.00
합계: $27.00 (약 3만 8천 원)

Claude Opus 5
입력: 6 × $5.00 = $30.00
출력: 1.5 × $25.00 = $37.50
합계: $67.50 (약 9만 5천 원)

환율 1,400원 가정, 캐싱·할인·세금 제외한 단순 비교입니다. 실제 개인 결과와 다를 수 있습니다.

청구 단위는 “요청 수”가 아니라 토큰입니다. 시스템 프롬프트가 길거나 대화 이력을 매번 다시 보내는 챗봇 구조라면 입력 토큰이 요청마다 누적됩니다. 위 가정보다 몇 배 커질 수 있습니다. 요청당 평균 토큰은 추정하지 말고 응답에 포함된 usage 값을 기록해 실측해야 합니다.

캐싱과 Batch를 쓰면 절반 아래로 내려갑니다

같은 시스템 프롬프트나 문서를 반복해서 보내는 구조라면 프롬프트 캐싱이 가장 큰 절감 수단입니다. 캐시에 쓸 때는 기본 입력가의 1.25배(5분 유지 기준)를 냅니다. 캐시에서 읽을 때는 0.1배만 냅니다. 긴 지침을 매 요청 다시 보내는 대신 캐시 히트로 처리하면 그 부분 입력 비용이 90% 줄어드는 셈입니다. 다만 5분 안에 재요청이 없으면 캐시가 사라져 다시 쓰기 비용이 발생합니다. 요청 간격이 뜸한 작업에서는 효과가 제한적입니다.

즉시 응답이 필요 없는 대량 작업은 Batch API가 입력·출력 모두 50% 할인입니다. Sonnet 5 기준 $1/$5, Haiku 4.5 기준 $0.50/$2.50까지 내려갑니다. 야간 문서 분류, 대량 요약, 데이터 정제가 대상입니다. 몇 시간의 지연을 받아들일 수 있는 작업이면 됩니다. 두 할인은 중복 적용됩니다. 반복 컨텍스트가 큰 대량 작업이라면 캐싱과 Batch를 함께 설계할 가치가 있습니다.

반대 방향의 추가 비용도 있습니다. 웹 검색 도구는 토큰 요금과 별도로 검색 1,000회당 $10가 부과됩니다. 미국 내 처리로 고정하는 inference_geo 옵션은 전체 요금에 1.1배가 붙습니다. 기본 설정만 쓰면 해당이 없습니다. 도구 호출이 많은 에이전트를 만든다면 토큰 외 항목을 청구서에서 따로 확인해야 합니다.

등급 선택은 단가표가 아니라 재시도율로 정합니다

Haiku가 한 번에 정확히 처리하는 작업이라면 Opus를 쓸 이유가 없습니다. 반대로 Haiku가 세 번 재시도하고도 사람이 고쳐야 하는 작업이라면 Opus 한 번이 더 쌉니다. 실제 업무 데이터 50건 정도로 등급별 성공률과 소모 토큰을 재보고 정하는 편이 단가표만 비교하는 것보다 정확합니다.

분류·추출·라우팅Haiku 4.5부터 시험, 실패율이 낮으면 그대로 확정

요약·초안·일반 대화Sonnet 5에서 품질과 비용의 균형 측정

복잡한 추론·코드·에이전트Opus 5와 Sonnet 5의 작업 성공률 비교 후 결정

대량 비동기 처리Batch 50% 할인 + 캐싱 중복 적용 검토

Claude Code나 claude.ai 구독을 이미 쓰고 있다면 그 구독 한도로 해결되는 작업까지 API로 옮길 필요는 없습니다. API가 필요한 순간은 사람 없이 돌아가는 자동화 파이프라인에 모델을 넣을 때입니다. 그 경계를 먼저 정하면 이중 지출을 피할 수 있습니다.

Claude API 최신 가격 문서 확인 ↗

확인한 공식 자료

Anthropic 공식 가격 문서(모델 단가, 프롬프트 캐싱, Batch, 도구 요금)를 2026년 8월 28일 확인했습니다.

Claude API 공식 가격 문서 ↗