Sonnet 5.5 API 요금: 캐시와 작업 완료 비용 계산하기
Sonnet 5.5의 입력·출력·캐시·Batch 요금을 계산 예제로 살펴봅니다. 토큰 단가와 재시도까지 포함한 작업 완료 비용을 구분하세요.
Claude Sonnet 5.5의 표준 Claude API 요금은 입력 100만 토큰당 2달러, 출력 100만 토큰당 10달러입니다. 캐시 읽기는 100만 토큰당 0.20달러입니다. 이는 2026년 9월 29일 확인한 공급사의 공시 요금이며, Ofox 견적이나 Claude 구독 요금이 아닙니다. 예산을 정하려면 애플리케이션이 검수 기준을 통과하는 작업 하나를 끝내는 데 과금 대상 토큰을 얼마나 쓰는지 알아야 합니다.
Sonnet 5에서 옮겨도 요금표 자체는 같습니다. Anthropic이 여러 작업에서 비용이 줄었다고 설명하는 것은 모델 동작과 토큰 소비에 관한 주장입니다. 모든 요청에 적용되는 일괄 할인이 아닙니다. 공식 모델 사양을 먼저 확인하고 실제 처리할 작업을 기준으로 계산하세요.
Sonnet 5.5 요금표
| 토큰 구분 | 100만 토큰당 USD | 집계 대상 |
|---|---|---|
| 캐시를 사용하지 않는 입력 | $2.00 | 캐시 생성이나 읽기로 청구되지 않는 입력 |
| 출력 | $10.00 | 과금되는 thinking 사용량을 포함한 출력 |
| 5분 캐시 생성 | $2.50 | 해당 캐시 구간에 기록한 토큰 |
| 1시간 캐시 생성 | $4.00 | 해당 캐시 구간에 기록한 토큰 |
| 캐시 읽기 | $0.20 | 프롬프트 캐시에서 실제로 읽은 토큰 |
모델 페이지에는 Batch API 입력·출력 50% 할인과 캐시 가능한 프롬프트의 최소 길이인 512토큰도 명시돼 있습니다. 길이를 충족한다고 캐시가 자동으로 만들어지지는 않습니다. 캐시를 설정하고 사용량 필드를 확인하세요. 캐시 토큰을 일반 입력에도 더해 중복 계산하지 않아야 합니다.
도구 요금, 데이터 저장 지역 옵션 등 서비스별 추가 비용은 전체 요금 문서에서 따로 확인해야 합니다. 제공 업체마다 지원 기능, 통화, 과금 규칙이 다를 수 있습니다. 이 공급사 계산법을 다른 엔드포인트에 적용하기 전에 해당 업체의 최신 조건을 확인하세요.
작은 요청의 예: 0.04달러는 월 예산이 아니다
캐시 없는 입력 10,000토큰과 과금 대상 출력 2,000토큰을 사용하는 가상 요청을 계산하면 다음과 같습니다.
입력: 10,000 / 1,000,000 × $2 = $0.02
출력: 2,000 / 1,000,000 × $10 = $0.02
합계: $0.04
모든 요청이 정확히 이 사용량이라면 1,000건은 기타 요금을 제외하고 40달러입니다. 이는 산술 예제이지 Sonnet의 일반적인 응답 길이를 측정한 값이 아닙니다. 추론이 길어지거나 도구를 한 번 더 호출하거나 재시도하면 합계가 달라집니다. 화면에 보이는 답변의 단어 수에 추정 환산 계수를 곱하는 방식은 신뢰할 만한 과금 계산법이 아닙니다.
캐시를 사용하면 계산이 어떻게 달라질까
요청 10건이 100,000토큰의 공통 접두부를 공유한다고 가정해 보겠습니다. 5분 캐시 쓰기 1회, 유효 시간 안의 실제 캐시 적중 9회, 그 외 입력과 출력은 없다는 조건입니다. 쓰기 0.25달러에 읽기 9 × 0.02달러를 더하면 0.43달러입니다. 캐시 없이 10번 처리하는 2.00달러보다 이 접두부에 한해 1.57달러, 78.5% 적습니다.
전체 애플리케이션 비용이 78.5% 할인된다는 뜻은 아닙니다. 접두부 변경, 캐시 미적중, 많은 출력이 발생하면 전체 절감률은 줄어듭니다. 요청마다 캐시 생성과 읽기 사용량을 기록하세요. 캐시에 적합한 프롬프트를 만들었다는 사실만으로 실제 캐시 적중 요금이 적용됐다고 볼 수는 없습니다.
비대화형 작업이 이용 조건을 충족한다면 Batch도 별도로 평가할 수 있습니다. 위의 캐시 없는 0.04달러 예제에 공시된 입력·출력 50% 할인을 적용하면 같은 조건에서 0.02달러입니다. 이 예제는 Batch와 캐시를 함께 적용하지 않았으며, 모든 조합의 과금 방식을 설명하지도 않습니다.
검수를 통과한 작업당 비용 측정하기
버그 수정, 문서 작성, 추출 작업에 다음 기록표를 사용할 수 있습니다.
작업 ID | 모델 | Effort | 입력 | 캐시 쓰기 | 캐시 읽기
출력 | 도구 요금 | 시도 횟수 | 검수 통과 여부 | 총 USD
실패한 시도와 재시도도 해당 작업 비용에 포함하세요. 테스트 통과, 필수 필드의 정확성, 결과물 검수표 등 합격 기준을 먼저 정한 뒤 총비용을 통과한 작업 수로 나눕니다. 구독 사용량은 별도 열에 기록하세요. CLI가 추정한 API 환산 비용이 구독 청구서에 실제로 부과되는 금액은 아닐 수 있습니다.
Effort도 기록해야 합니다. Artificial Analysis의 출시 평가는 max에서 출력 소비량이 매우 높았다고 보고했습니다. 해당 벤치마크로 내 청구액을 예측할 수는 없습니다. 구조화 출력 문제가 있던 출시 전 배포 환경을 사용했고 재평가에 관한 단서도 있으므로 함께 읽어야 합니다. 작업 사용량을 측정할 이유는 되지만 Sonnet이 언제나 비싸다는 근거는 아닙니다.
다음으로 확인할 항목
요금표는 이해했지만 청구액을 설명하기 어렵다면 공급사를 바꾸기 전에 실제 출력 토큰, 캐시 적중, 재시도 횟수를 비교하세요. 설정 조정은 Sonnet 5.5 effort 가이드, 모델 선택은 코딩 작업의 Sonnet과 Opus 비교에서 이어집니다.
Ofox 모델 카탈로그에서 현재 제공 모델과 공급사 정보를 확인할 수 있습니다. 이 글은 특정 Sonnet 엔드포인트, 가격, 기능을 Ofox에서 이용할 수 있다고 확인한 자료가 아닙니다. 요청 전에 정확한 모델과 프로토콜을 확인하세요.
자주 묻는 질문
- Sonnet 5보다 토큰 단가가 낮아졌나요?
- 아니요. 현재 공식 문서상 단가는 같습니다. 다만 작업에 필요한 토큰 수가 늘거나 줄면 단가 변화 없이도 총비용이 달라집니다.
- Claude Pro나 Team 구독에 API 크레딧이 포함되나요?
- 구독 사용 한도를 API 크레딧으로 취급하지 마세요. 클라이언트의 결제 경로를 확인하고, 해당 요금제와 Claude API 요금표를 따로 검토해야 합니다.
- max가 작업을 끝내는 가장 저렴한 방법인가요?
- 일반적으로 보장할 수 없습니다. 여러 effort 설정에서 재시도와 소요 시간을 포함해 통과한 결과를 비교하세요. 합격률은 높아지지 않으면서 출력만 훨씬 많아질 수 있습니다.


