Fable 5.1 vs Fable 5 vs Opus 5: 전부 캐시에 달렸다
Claude Fable 5.1은 Fable 5의 $10/$50 기본 요금을 그대로 유지합니다. 인하된 것은 캐시 읽기 하나, $1에서 $0.25로. 그 25%가 실제로 손에 들어오는 조건과, Opus 5가 여전히 이기는 지점.
Claude Fable 5.1은 2026년 9월 1일에 더 싼 Fable로 나왔습니다. 기본 요금은 움직이지 않았습니다. 입력은 여전히 100만 토큰당 $10, 출력은 $50으로 Fable 5와 같습니다. 인하된 것은 캐시 읽기 한 줄, $1에서 $0.25입니다. 일반 워크로드 25%, 에이전트 워크로드 최대 45%라는 Anthropic의 추정치는 전부 이 75% 인하 위에 서 있습니다.
이 인하가 청구서에 닿는 정도는 입력 중 실제로 캐시에서 나오는 비중에 정확히 비례합니다. 헤드라인만 보고 움직이기 전에 요금표부터 보세요.
다들 건너뛰는 그 표
Anthropic은 모델마다 다섯 가지 요금을 공개하는데, 대부분의 요약은 그중 하나만 인용합니다. 100만 토큰당 달러로 전부 옮기면 이렇습니다.
| 모델 | 기본 입력 | 5분 캐시 쓰기 | 1시간 캐시 쓰기 | 캐시 읽기 | 출력 |
|---|---|---|---|---|---|
| Fable 5.1 | 10 | 12.50 | 20 | 0.25 | 50 |
| Fable 5 | 10 | 12.50 | 20 | 1.00 | 50 |
| Opus 5 | 5 | 6.25 | 10 | 0.50 | 25 |
| Sonnet 5 | 2 | 2.50 | 4 | 0.20 | 10 |
Fable 두 행을 나란히 놓고 보세요. 다섯 중 넷이 똑같습니다. Fable 5.1은 더 싼 모델이 아닙니다. 같은 값의 같은 모델인데 캐시만 싸진 것입니다.
청구서에서는 어떤 의미인가
캐시 절감은 재사용과 함께 불어납니다. 요금 한 줄이 바뀌었을 뿐인데 워크로드마다 결과가 이렇게 다른 이유가 여기 있습니다. 100만 토큰짜리 프리픽스 하나를 잡습니다. 코드베이스든 문서 묶음이든 긴 시스템 프롬프트든 상관없습니다. 캐시에 한 번 쓰고 N번 읽습니다. ‘캐싱 없음’ 열은 같은 내용을 100만 토큰당 $10로 N+1번 통째로 보내는 비용입니다.
| 읽기 횟수 | Fable 5 | Fable 5.1 | 캐싱 없음 | 5.1 우위 |
|---|---|---|---|---|
| 1 | $13.50 | $12.75 | $20.00 | 1.06배 |
| 10 | $22.50 | $15.00 | $110.00 | 1.50배 |
| 100 | $112.50 | $37.50 | $1,010.00 | 3.00배 |
| 500 | $512.50 | $137.50 | $5,010.00 | 3.73배 |
5분 캐시 쓰기 한 번, 읽기 사이에 만료 없음을 가정했습니다. 읽기가 항목을 무료로 갱신하므로 쉬지 않고 도는 에이전트에서는 이 가정이 성립합니다. 프리픽스가 식어서 다시 써야 한다면 두 Fable 열에 다시 쓸 때마다 $12.50씩 더하세요. 아래 TTL 절을 참고하세요.
한 번 읽으면 두 버전은 6% 이내로 붙어 있습니다. 백 번 읽으면 Fable 5.1이 Fable 5의 3분의 1입니다. 이 행들 사이에서 모델은 아무것도 바뀌지 않았습니다. 바뀐 것은 같은 캐시된 컨텍스트로 몇 번 돌아왔는가뿐입니다.
Anthropic의 두 수치가 그렇게 멀리 떨어져 있는 이유입니다. 세션당 캐시된 컨텍스트를 몇 번 건드리는 정도의 워크로드는 25% 근처에 떨어집니다. 오후 내내 같은 저장소를 수백 번 다시 읽는 장시간 에이전트가 ‘최대 약 45%’ 쪽 끝이 가리키는 대상입니다. 어느 쪽인지 알려면 요청 수가 아니라 캐시 적중 수를 세야 합니다.
구체적인 예를 봅시다. 입력 100만 토큰 중 90%가 캐시 읽기이고 출력이 2만 토큰인 경우입니다.
- Fable 5 — 캐시 $0.90 + 신규 입력 $1.00 + 출력 $1.00 = $2.90
- Fable 5.1 — 캐시 $0.225 + 신규 입력 $1.00 + 출력 $1.00 = $2.225
23% 절감으로, 일반적인 사용에 대한 Anthropic의 추정치 25%와 맞아떨어집니다. 어디서 나온 절감인지 보세요. 캐시 줄이 4분의 3만큼 떨어졌지만, 애초에 청구서의 31% 정도밖에 되지 않던 줄입니다.
TTL 선택이 인하폭보다 비싸다
Anthropic은 캐시 쓰기 지속 시간을 두 가지로 파는데, 대부분의 비용 모델이 빼먹는 부분이 바로 이것입니다. 5분 캐시 쓰기는 100만 토큰당 $12.50, 1시간 쓰기는 $20입니다.
5분 시계는 들리는 것보다 헐겁습니다. Anthropic의 프롬프트 캐싱 문서는 캐시된 내용이 사용될 때마다 추가 비용 없이 캐시가 갱신된다고 명시합니다. 수명은 항목을 쓰거나 읽는 각 요청의 시작 시점부터 측정됩니다. 같은 프리픽스를 쉬지 않고 두드리는 에이전트는 읽기만으로 5분 항목을 살려 두고 쓰기 요금은 딱 한 번만 냅니다.
돈은 사이의 빈 시간에서 샙니다. 계획을 세우는 턴, 느린 툴 호출, 사람이 diff를 검토하는 시간 — 5분보다 긴 조용한 구간이 생기면 항목이 만료되고 다음 호출이 쓰기 요금을 다시 냅니다. 한 시간 내내 그 패턴이면 최악의 경우 12 × $12.50 = $150, 1시간 쓰기 한 번이면 $20입니다.
이 최악의 경우는 프리픽스 하나당 시간당 $130 격차로, Fable 5.1이 내놓은 캐시 읽기 인하 전체보다 큽니다. 그리고 이 격차를 결정하는 것은 어떤 모델을 골랐는지가 아니라 트래픽의 모양입니다. 쉬지 않고 바쁜 에이전트는 여기에 절대 닿지 않을 수도 있고, 턴 사이에 노는 에이전트는 반드시 닿습니다. 새 요금을 예산에 반영하기 전에 자신이 어느 쪽을 돌리고 있는지부터 정리하세요.
Fable 5.1 대 Opus 5: 숫자 속의 함정
한 줄은 실제로 뒤집힙니다. Fable 5.1은 캐시된 토큰을 $0.25에 읽고, 이는 Opus 5의 $0.50의 절반입니다. Fable의 기본 입력이 Opus 5의 두 배이고 출력도 두 배로 비싼데도 그렇습니다.
그러니 캐시를 많이 쓰는 에이전트라면 이제 Fable로 올라가야 한다고 결론 내리기 쉽습니다. 식은 반대로 말합니다. 입력을 I, 캐시 읽기 비중을 f, 출력을 O라고 하면 Fable 5.1이 싼 조건은 다음과 같습니다.
10(1−f)·I + 0.25f·I + 50·O < 5(1−f)·I + 0.50f·I + 25·O
→ 5I − 5.25f·I + 25O < 0
→ f > (5 + 25·(O/I)) / 5.25
출력을 0으로 두면 — 아무것도 생성하지 않는 워크로드입니다 — 그래도 **f > 95.2%**가 필요합니다. 실제로 생성하는 토큰 하나하나가 이 문턱을 더 밀어 올립니다. Fable 5.1이 총비용에서 Opus 5를 밑도는 현실적인 조합은 없습니다.
위의 예가 이를 그대로 보여 줍니다. 같은 트래픽에서 Fable 5.1은 $2.225, Opus 5는 $1.45입니다. 한 줄이 싸다고 나머지 전부가 2배인 모델을 떠받칠 수는 없습니다.
그래서 판단 기준은 바뀌지 않고 한 축에서 비용만 줄었습니다. Fable 5.1은 그 성능이 필요할 때 고르는 것이지, Opus 5보다 싸게 쓰려고 고르는 모델이 아닙니다. 새 캐시 요금이 사 주는 것은, 긴 에이전트 실행 내내 Mythos급 모델에 머무는 대가가 Fable 5 때보다 작아졌다는 사실입니다.
독립 측정도 같은 곳을 가리킨다
모델의 출시 전 평가에 참여한 Artificial Analysis가 9월 1일에 공개한 작업당 비용 수치가 정확히 이 지점에 떨어집니다. 이들의 요약은 Fable 5.1이 Artificial Analysis Intelligence Index에서 1위지만, 캐시 읽기가 75% 인하됐음에도 작업당 비용은 Fable 5보다 20% 비싸다는 것입니다.
| 모델 (max effort) | Intelligence Index | 작업당 비용 |
|---|---|---|
| Fable 5.1 | 66 | $3.76 |
| Opus 5 | 63 | $2.34 |
| Fable 5 | 62 | $3.14 |
이유는 이 글이 계속 맴돌던 식의 나머지 절반입니다. Fable 5.1은 max effort에서 Fable 5의 약 1.7배에 해당하는 출력 토큰을 씁니다. 출력은 $50 줄이고, $0.25 줄에 붙은 할인은 거기까지 닿지 않습니다. 캐시가 싸졌다고 모델이 싸진 것은 아닙니다. 같은 작업 세트에서 끝까지 재 보면 자기 전임자보다 20% 비싸졌고 Opus 5의 1.6배입니다.
동시에 이들이 측정한 모든 모델 중 최고 점수이기도 합니다. 실제 교환 조건은 이렇습니다. 지수의 꼭대기를 사는 대신 작업당 비용은 전보다 더 내는 것이지, 덜 내는 것이 아닙니다.
가격 말고 Anthropic이 바뀌었다고 말한 것
Claude Fable 제품 페이지는 벤치마크가 아니라 동작을 구체적으로 말합니다. Fable 5.1이 “쉬워 보이는 지름길을 피하고, 증상이 아니라 문제의 근본 원인을 고치며, 작업하는 동안 사용자에게 계속 상황을 알린다”고 적혀 있습니다. (별도의 출시 발표는 같은 내용을 다르게 표현하므로, 인용이 어느 페이지에서 왔는지 밝히는 편이 좋습니다.) 가장 강한 구체적 주장은 Anthropic 자신의 말이 아닙니다. 같은 페이지에 인용된 Red Hat의 Distinguished Engineer Josh Boyer의 말입니다. “Claude Code로, 저희가 테스트한 모든 깨진 빌드에서 근본 원인을 정확히 짚어 냈습니다. 모든 effort 단계에 걸쳐서요.”
앞의 것은 벤더가 자기 모델을 설명한 것이고, 뒤의 것은 고객이 자기 테스트를 설명한 것입니다. 둘 다 벤치마크가 아니며, 이를 근거로 라우팅 정책을 다시 쓰기 전에 각자의 깨진 빌드에서 재현해 볼 값어치가 있습니다. Anthropic의 발표 페이지에는 Terminal-Bench-Science, Terminal-Bench, OSWorld, HLE 등 전체 벤치마크 표가 실려 있습니다. 이 글은 그쪽을 일부러 건드리지 않고 돈 이야기만 합니다. 출시 보도가 틀린 쪽이 비용 이야기였기 때문입니다.
혼동하기 쉬운 안전장치 변경이 둘 있고, 실제로 여러 글이 이를 섞어 썼습니다. Anthropic은 2026년 8월 7일에 Claude Fable 5의 생물학 관련 안전장치를 재조정하면서 이 업데이트가 “우리 제품 표면 전반에서 생물학 관련 폴백을 약 85% 줄였다”고 보고했습니다. 이와 별개로 9월 1일 출시 발표는 사이버보안에서 Fable 5.1의 “최신 안전장치가 이전보다 60% 적은 오탐을 차단한다”고 말합니다. 즉 오탐이 줄었다는 것은 5.1 출시의 진짜 주장이 맞지만 사이버보안 쪽 이야기입니다. 8월의 생물학 변경과는 다른 건이고, 두 숫자를 더해서는 안 됩니다.
사양, 그리고 자주 놓치는 한 줄
| Fable 5.1 | Opus 5 | Sonnet 5 | |
|---|---|---|---|
| 사고(thinking) | 적응형 (항상 켜짐) | 적응형 | 적응형 |
| 기본 effort | high | high | high |
| 컨텍스트 윈도우 | 100만 | 100만 | 100만 |
| 최대 출력 | 128K | 128K | 128K |
| 신뢰할 수 있는 지식 컷오프 | 2026년 6월 | 2026년 5월 | 2026년 1월 |
모델 ID는 claude-fable-5-1입니다. 컨텍스트와 출력 한도는 셋 다 같으므로 차별점은 가격, 동작, 그리고 마지막 행입니다. 여기 있는 세 모델 중 Fable 5.1의 지식 컷오프가 가장 최신입니다. Opus 5보다 한 달, Sonnet 5보다 다섯 달 더 최신입니다. 최근 라이브러리 버전이나 API를 건드리는 작업이라면 이 차이가 실제로 일을 합니다.
Mythos 5.1은 같은 요금표에 같은 요금으로 등장합니다. Anthropic의 발표는 둘이 “같은 기반 모델”이며 둘 사이의 차이는 “이전의 덜 정밀했던 사이버 안전장치가 개입하던 작업들을 반영한다”고 밝힙니다. 접근은 신뢰 접근 프로그램을 통하는데 두 프로그램의 단계가 같지 않습니다. Life Sciences Verification Program은 초대제 베타로 지금 접근 권한을 주고, Cyber Verification Program은 현재 사이버 안전장치를 완화한 Opus급·Sonnet급 모델까지만 다룹니다. Mythos에 대해 Anthropic은 이렇게 씁니다. “가까운 시일 안에 이 프로그램은 Claude Mythos급 모델 접근도 포함할 예정입니다.” 현재 제공 범위는 미국 내 일부 조직으로 한정되어 있습니다. 일반적인 용도로 그냥 바꿔 끼울 수 있는 선택지가 아닙니다.
하나 고르기
| 워크로드 | 선택 |
|---|---|
| 장시간 에이전트 실행, 캐시 재사용 많음, 가장 어려운 작업 | Fable 5.1 — 프리미엄이 줄었지만 여전히 프리미엄입니다 (Ofox에서는 anthropic/claude-fable-5.1) |
| 복잡한 에이전트 코딩, 엔터프라이즈 업무, 비용이 중요 | Opus 5 — 현실적인 모든 조합에서 더 쌉니다 |
| 대량 처리, 지연 시간에 민감, 품질은 충분하면 됨 | Sonnet 5 — 같은 100만 컨텍스트에 $2/$10 |
| 이미 Fable 5를 쓰는 중 | 기본 요금 동일, 캐시는 더 쌈, 컷오프는 더 최신 — 옮길 값어치가 있습니다. Ofox 카탈로그에 anthropic/claude-fable-5.1로 올라와 있습니다 |
그다음에 캐시 TTL을 확인하세요. 한 시간짜리 에이전트라면 그 설정 하나가 이 글이 다룬 요금 변화보다 더 많은 돈을 흔듭니다.
제공 현황
Fable 5.1은 2026년 9월 3일 Ofox 카탈로그에 추가됐습니다. 등록명은 anthropic/claude-fable-5.1이고 별칭 claude-fable-5-1도 해석됩니다. 다섯 가지 요금 모두 Anthropic 정가와 같고 추가 요금이 없으므로 이 글의 모든 수치가 그대로 적용됩니다. anthropic/claude-fable-5, anthropic/claude-opus-5, anthropic/claude-sonnet-5와 나란히 있고, 넷 다 Ofox 키 하나로 두 프로토콜 어느 쪽에서든 호출됩니다. OpenAI 호환 base URL은 https://api.ofox.ai/v1, Anthropic 네이티브 base URL은 https://api.ofox.ai/anthropic입니다.
요금과 사양은 2026년 9월 2일 Anthropic의 요금, 모델 문서, 제품 페이지, 출시 발표에 대조해 확인했고 9월 3일에 다시 확인했습니다. 작업당 비용 수치는 2026년 9월 1일 공개된 Artificial Analysis 자료입니다.
자주 묻는 질문
- Claude Fable 5.1은 Fable 5보다 싼가요?
- 캐시된 입력에서만 그렇습니다. 기본 입력은 100만 토큰당 $10, 출력은 $50 그대로이고 둘 다 Fable 5와 같습니다. 바뀐 줄은 캐시 읽기 하나로, 100만 토큰당 $1에서 $0.25가 됐습니다. Anthropic은 이것이 75% 인하이며 일반적인 워크로드의 비용을 약 25%, 에이전트 성격이 강한 워크로드는 최대 약 45%까지 줄인다고 밝혔습니다. 캐시에서 읽는 일이 드문 워크로드라면 청구서는 거의 그대로입니다.
- Fable 5.1의 캐시 읽기가 Opus 5보다 쌉니다. 그러면 전체적으로도 더 싼가요?
- 아닙니다. Fable 5.1은 캐시된 토큰을 $0.25에 읽고 Opus 5는 $0.50이지만, 기본 입력($10 대 $5)과 출력($50 대 $25)은 둘 다 두 배입니다. 식을 풀어 보면 Fable 5.1이 총비용에서 이기는 경우는 캐시 읽기가 입력의 약 95%를 넘고 출력이 0에 가까울 때뿐입니다. 현실의 워크로드가 아닙니다. Fable 5.1은 성능이 필요해서 고르는 것이지 Opus 5보다 싸게 쓰려고 고르는 모델이 아닙니다.
- Claude Fable 5.1의 모델 ID와 컨텍스트 윈도우는 어떻게 되나요?
- 모델 ID는 claude-fable-5-1입니다. 컨텍스트 윈도우 100만 토큰, 최대 출력 12만 8천 토큰, 적응형 사고 항상 켜짐, 기본 effort는 high입니다. 신뢰할 수 있는 지식 컷오프는 2026년 6월로 Opus 5보다 한 달, Sonnet 5보다 다섯 달 더 최신입니다.
- Claude Mythos 5.1은 무엇인가요?
- Anthropic은 Mythos 5.1과 Fable 5.1이 같은 기반 모델이며 안전장치에서 차이가 난다고 밝혔고, 두 모델을 같은 요금으로 표기하고 있습니다. Mythos는 신뢰 접근 프로그램을 통해 제공되는데 두 프로그램의 단계가 다릅니다. Life Sciences Verification Program은 초대제 베타로 지금 접근 권한을 주고, Cyber Verification Program은 가까운 시일 안에 Mythos 접근을 포함할 예정입니다. 현재 제공 범위는 미국 내 일부 조직으로 한정되어 있어서, 일반 API 키로 그냥 호출할 수 있는 모델이 아닙니다.
- 지금 Ofox로 Fable 5.1을 호출할 수 있나요?
- 네. Fable 5.1은 2026년 9월 3일 Ofox 카탈로그에 anthropic/claude-fable-5.1로 추가됐고, Anthropic 정가에 추가 요금 없이 다섯 가지 요금이 모두 일치합니다. Fable 5, Opus 5, Sonnet 5와 같은 키로 OpenAI 호환 프로토콜과 Anthropic 네이티브 프로토콜 어느 쪽으로든 호출됩니다.


