Claude Fable 5.1 API: 모델 ID, 요금, effort, 캐시 TTL
Fable 5.1의 모델 ID와 공개된 다섯 가지 요금, effort가 실제로 청구서에 미치는 영향, 그리고 인하된 캐시 요금보다 더 큰 돈이 걸린 캐시 TTL 선택까지 정리했습니다.
Claude Fable 5.1은 2026년 9월 1일에 출시됐습니다. 이 글은 레퍼런스입니다. 식별자, 공개된 다섯 가지 요금, 그리고 인하된 요금이 아껴 주는 것보다 더 큰 돈이 걸린 캐시 TTL 선택을 다룹니다. Opus 5와의 비용 비교는 Fable 5.1 vs Fable 5 vs Opus 5에서 따로 다뤘습니다.
식별자
| 항목 | 값 |
|---|---|
| 모델 ID | claude-fable-5-1 |
| 컨텍스트 윈도우 | 100만 토큰 |
| 최대 출력 | 12만 8천 토큰 |
| 사고(thinking) | 적응형, 항상 켜짐 |
| 기본 effort | high |
| 신뢰할 수 있는 지식 컷오프 | 2026년 6월 |
이 모델에서는 적응형 사고를 끌 수 없습니다. 예산을 잡을 때 이게 중요합니다. 사고 토큰은 출력으로 과금되기 때문입니다. $10 줄이 아니라 $50 줄입니다.
다섯 가지 요금 전부
Anthropic은 모델마다 다섯 가지 요금을 공개합니다. 대부분의 글은 그중 하나만 인용합니다. 100만 토큰당 달러 기준입니다.
| Fable 5.1 | Fable 5 | Opus 5 | Sonnet 5 | |
|---|---|---|---|---|
| 기본 입력 | 10 | 10 | 5 | 2 |
| 5분 캐시 쓰기 | 12.50 | 12.50 | 6.25 | 2.50 |
| 1시간 캐시 쓰기 | 20 | 20 | 10 | 4 |
| 캐시 읽기 | 0.25 | 1.00 | 0.50 | 0.20 |
| 출력 | 50 | 50 | 25 | 10 |
Fable 두 열을 나란히 놓고 보세요. 다섯 중 넷이 똑같습니다. 이번 버전 업은 정확히 한 줄만 움직였습니다.
effort는 단가가 아니라 토큰 수를 바꾼다
effort는 요금제 등급이 아닙니다. 위의 토큰당 단가는 어느 effort에서도 그대로입니다. effort가 바꾸는 것은 모델이 답하기 전에 얼마나 많이 쓰는가입니다.
출시 전 평가에 참여한 Artificial Analysis는 max effort에서 Fable 5.1이 Fable 5의 약 1.7배에 해당하는 출력 토큰을 쓴다고 측정했습니다. 출력은 $50 줄입니다. 캐시 읽기가 75% 싸졌는데도 이들의 작업당 비용이 Fable 5의 $3.14 대비 $3.76으로 20% 높게 나온 이유입니다.
예산 규칙은 이렇게 정리됩니다. effort를 올리면 단가가 아니라 물량을 통해 청구서가 올라갑니다. 비용에 민감하다면 다른 것을 최적화하기 전에 effort부터 제한하세요.
캐싱의 값어치
$0.25짜리 캐시 읽기는 $10짜리 기본 입력의 40분의 1입니다. 재사용이 쌓일수록 절감도 같이 쌓입니다.
100만 토큰짜리 프리픽스 하나를 잡아 봅시다. 코드베이스든, 문서 묶음이든, 긴 시스템 프롬프트든 상관없습니다. 한 번 쓰고 N번 읽습니다.
| 읽기 횟수 | Fable 5.1 | Fable 5 | 캐싱 없음 |
|---|---|---|---|
| 1 | $12.75 | $13.50 | $20.00 |
| 10 | $15.00 | $22.50 | $110.00 |
| 100 | $37.50 | $112.50 | $1,010.00 |
| 500 | $137.50 | $512.50 | $5,010.00 |
이 표는 5분 쓰기 한 번, 읽기 사이에 만료 없음을 가정합니다. ‘캐싱 없음’ 열은 같은 내용을 100만 토큰당 $10로 N+1번 통째로 다시 보내는 경우입니다.
한 번만 읽으면 두 버전의 차이는 6% 이내입니다. 백 번 읽으면 Fable 5.1이 Fable 5의 3분의 1입니다. 이 행들 사이에서 모델은 동일합니다. 바뀌는 것은 캐시 적중 횟수뿐입니다. 측정해야 할 숫자가 바로 이것입니다.
TTL 선택
Anthropic은 캐시 쓰기 지속 시간을 두 가지로 팝니다. 5분은 100만 토큰당 $12.50, 1시간은 $20입니다. 5분 시계는 읽기에서도 초기화됩니다. Anthropic의 프롬프트 캐싱 문서는 캐시된 내용이 사용될 때마다 추가 비용 없이 캐시가 갱신되며, 수명은 항목을 쓰거나 읽는 모든 요청을 기준으로 측정된다고 분명히 밝히고 있습니다. 같은 프리픽스를 계속 때리는 에이전트는 읽기만으로 5분 항목을 열어 두고 쓰기 요금은 딱 한 번만 냅니다.
돈이 새는 곳은 그 사이의 빈 시간입니다. 5분을 넘기는 멈춤이라면 무엇이든 — 느린 툴 호출이든, 사람이 diff를 읽는 시간이든 — 항목이 만료되고 다음 호출이 쓰기 요금을 다시 냅니다. 한 시간 내내 그런다면 최악의 경우 12 × $12.50 = $150, 1시간 쓰기 한 번이면 $20입니다.
프리픽스 하나당 시간당 $130이라는 이 격차는 모델 선택이 아니라 트래픽 패턴이 결정합니다. 그래서 버전이 올라가도 그대로 남아 있습니다.
Fable 5에서 옮기기
바뀌는 것은 문자열 하나입니다. 기본 요금, 컨텍스트 윈도우, 출력 상한, 기본 effort가 모두 그대로라서 모델 ID 교체가 마이그레이션의 전부입니다.
- model="claude-fable-5"
+ model="claude-fable-5-1"
바꾼 다음에 확인할 것이 둘 있습니다. 둘 다 diff에는 보이지 않습니다.
- 출력 예산. 단가는 같지만 Artificial Analysis가 max effort에서 약 1.7배의 출력 토큰을 측정했습니다. Fable 5의 출력 물량에 맞춰 알림을 걸어 뒀다면 그 알림이 울립니다.
- 지식 컷오프 가정. 2026년 6월 컷오프라는 것은, 오래된 라이브러리 지식을 우회하려고 넣어 둔 프롬프트가 이제 불필요해졌거나 더 나쁘게는 오히려 틀린 내용이 됐을 수 있다는 뜻입니다.
가격 말고 Anthropic이 바뀌었다고 말한 것
Claude Fable 제품 페이지는 벤치마크가 아니라 동작을 설명합니다. Fable 5.1이 “쉬워 보이는 지름길을 피하고, 증상이 아니라 문제의 근본 원인을 고치며, 작업하는 동안 사용자에게 계속 상황을 알린다”고 적혀 있습니다.
혼동하기 쉬운 안전장치 변경이 둘 있고, 실제로 여러 글이 이를 섞어 썼습니다. Anthropic은 2026년 8월 7일에 Fable 5의 생물학 관련 안전장치를 재조정하면서 이 업데이트가 “우리 제품 표면 전반에서 생물학 관련 폴백을 약 85% 줄였다”고 보고했습니다. 이와 별개로 9월 1일 출시 발표는 사이버보안 영역에서 Fable 5.1의 “최신 안전장치가 이전보다 60% 적은 오탐을 차단한다”고 말합니다. 즉 ‘오탐이 줄었다’는 것은 5.1 출시의 진짜 주장이 맞지만, 사이버보안 쪽 이야기입니다. 8월의 생물학 변경과는 다른 건이고, 두 숫자를 더해서는 안 됩니다.
Ofox로 호출하기
Fable 5.1은 2026년 9월 3일 기준으로 Ofox 카탈로그에 올라가 있습니다. 등록명은 anthropic/claude-fable-5.1입니다. Anthropic 자신의 모델 ID인 claude-fable-5-1도 별칭으로 해석되므로, Anthropic 직접 호출에서 옮겨 올 때 프로바이더 접두사 말고는 문자열을 바꿀 필요가 없습니다.
같은 키로 anthropic/claude-fable-5, anthropic/claude-opus-5, anthropic/claude-sonnet-5도 모두 Anthropic 정가에 추가 요금 없이 쓸 수 있습니다. 네 모델 모두 두 프로토콜 어느 쪽으로든 접근됩니다.
| 프로토콜 | Base URL |
|---|---|
| OpenAI 호환 | https://api.ofox.ai/v1 |
| Anthropic 네이티브 | https://api.ofox.ai/anthropic |
네이티브 경로에서는 Messages API를 씁니다. Ofox 문서는 이 경로에서 확장 사고와 도구 사용을 명시적으로 적어 두고 있지만 캐싱은 따로 언급하지 않습니다. 그러니 위의 TTL 계산을 믿고 예산을 잡기 전에, 반복 호출 첫 번째에서 usage.cache_read_input_tokens가 0이 아닌지부터 확인하세요.
import anthropic
client = anthropic.Anthropic(
base_url="https://api.ofox.ai/anthropic",
api_key="<OFOX_API_KEY>",
)
message = client.messages.create(
model="anthropic/claude-fable-5.1",
max_tokens=1024,
messages=[{"role": "user", "content": "이 저장소를 요약해 줘."}],
)
다섯 가지 요금 모두 Anthropic 정가와 같고 추가 요금이 없으므로 이 글의 모든 수치가 그대로 적용됩니다. 다만 싸진 캐시 읽기가 실제로 값어치를 하는지를 결정하는 것은 여전히 캐시 적중률입니다. 25%가 손에 들어온다고 가정하기 전에 자기 트래픽에서 직접 재 보세요.
요금과 사양은 2026년 9월 3일 Anthropic의 요금 문서, 모델 개요, 제품 페이지, 출시 발표에 대조해 확인했습니다. 작업당 비용 수치는 같은 날 Artificial Analysis에서 가져왔습니다. Ofox 카탈로그와 프로토콜 base URL은 2026년 9월 3일 라이브 /v1/models 엔드포인트와 Ofox 문서에 대조했습니다.
자주 묻는 질문
- Claude Fable 5.1의 모델 ID는 무엇인가요?
- claude-fable-5-1입니다. 컨텍스트 윈도우는 100만 토큰, 최대 출력은 12만 8천 토큰입니다. 적응형 사고가 항상 켜져 있고 끌 수 없으며, 기본 effort는 high입니다. 신뢰할 수 있는 지식 컷오프는 2026년 6월입니다.
- Claude Fable 5.1의 요금은 얼마인가요?
- Anthropic이 공개한 100만 토큰당 요금은 다섯 가지입니다. 기본 입력 $10, 5분 캐시 쓰기 $12.50, 1시간 캐시 쓰기 $20, 캐시 읽기 $0.25, 출력 $50입니다. 이 중 넷은 Fable 5와 완전히 같고, 캐시 읽기만 $1에서 $0.25로 바뀌었습니다.
- effort를 올리면 토큰당 단가가 달라지나요?
- 아닙니다. 토큰당 단가는 고정입니다. 달라지는 것은 모델이 만들어 내는 출력 토큰의 양입니다. Artificial Analysis는 max effort에서 Fable 5.1이 Fable 5의 약 1.7배에 해당하는 출력 토큰을 쓴다고 측정했고, 캐시가 싸졌는데도 작업당 비용이 20% 높게 나온 이유가 여기에 있습니다.
- 5분 TTL과 1시간 TTL 중 무엇을 써야 하나요?
- 에이전트가 중간에 쉬는지에 달려 있습니다. Anthropic 문서는 캐시된 내용이 사용될 때마다 추가 비용 없이 캐시가 갱신되며, 항목을 쓰거나 읽는 모든 요청에서 수명이 다시 시작된다고 밝히고 있습니다. 쉬지 않고 도는 에이전트는 읽기만으로 5분 항목을 계속 살려 둡니다. 5분보다 길게 멈추면 쓰기 요금을 다시 냅니다. 최악의 경우 한 시간에 12번 다시 써서 $150, 1시간 쓰기 한 번이면 $20입니다.
- 지금 Ofox로 Fable 5.1을 호출할 수 있나요?
- 네, 2026년 9월 3일 기준으로 가능합니다. Ofox 카탈로그에 anthropic/claude-fable-5.1로 올라가 있고 claude-fable-5-1이 별칭으로 동작합니다. 다섯 가지 요금 모두 Anthropic 정가와 같고 추가 요금은 없으며, 키 하나로 OpenAI 호환 프로토콜과 Anthropic 네이티브 프로토콜 양쪽에서 호출할 수 있습니다.


