Claude Fable 5.1, 표시가는 그대로인데 실비가 내렸다 — 캐시 읽기 4분의 1 (2026년 9월)

Anthropic이 Fable 5.1을 내며 입력 $10·출력 $50를 동결했다. 스티커만 보면 '변동 없음'이다. 그런데 장기 에이전트 작업의 실제 청구서를 결정하는 캐시 읽기 단가가 $1.00→$0.25로 4분의 1이 됐다. 캐시 히트율별로 실효 비용을 계산했다.

Claude API 단가 — 1M 토큰당입력 / 출력 · USD (세전)
입력출력
Claude Fable 5.1$10$50Claude Opus 5$5$25Claude Sonnet 5$2$10Claude Haiku 4.5$1$5
AI물가 관측 데이터 · 공식 출처 대조

Anthropic이 9월 1일 Claude Fable 5.1(과 Mythos 5.1)을 냈다. Fable 5의 후계로, 장기 에이전틱 코딩·연구용 최상위 모델이다. 요금표를 보면 입력 $10·출력 $50 — 이전 Fable 5와 똑같다. 스티커만 보면 "가격 변동 없음"이다.

그런데 하나가 바뀌었다. 캐시 읽기 단가가 1M 토큰당 $1.00 → $0.25로 4분의 1이 됐다. 본지가 늘 하는 말 — 장기 에이전트 작업의 청구서를 결정하는 건 스티커가 아니라 이런 곳이다.

왜 하필 캐시인가 — Fable이 하는 일 때문

Fable은 같은 코드베이스·문서·컨텍스트를 반복해서 읽는 장기 작업용이다. 이런 워크로드는 매 호출마다 거대한 프리픽스(코드·이력)가 반복 전송돼, 입력의 대부분이 캐시에서 나온다. 캐시 히트율이 80~95%까지 나오는 게 흔하다(캐싱 단가 읽는 법).

즉 Fable에서 실제로 청구서를 미는 건 일반 입력($10)이 아니라 캐시 읽기다. 그 캐시 읽기가 4분의 1이 됐으니, 스티커가 안 움직여도 실효 입력비는 내려간다.

참고로 이 $0.25는 입력 $10의 40분의 1이다. Claude의 표준 캐시 읽기가 대개 입력의 10분의 1인 걸 생각하면(Opus 5는 $5 입력에 캐시 $0.5), Fable 5.1은 재사용 많은 워크로드에 맞춰 캐시를 유난히 싸게 설계한 셈이다.

캐시 히트율별 실효 입력비

입력 1M 토큰 중 캐시에서 나오는 비율(히트율)에 따라 실효 입력비가 어떻게 갈리는지 계산했다(세전 USD, 출력 $50는 불변).

캐시 히트율 이전 (캐시 $1.00) 현재 (캐시 $0.25) 절감
0% (캐시 안 씀) $10.00 $10.00
50% $5.50 $5.13 7%
80% $2.80 $2.20 21%
90% $1.90 $1.23 36%
95% $1.45 $0.74 49%

히트율이 높을수록 절감폭이 커진다. Fable이 실제로 도는 구간(8095%)에서 실효 입력비가 2050% 내려간다. 캐시를 거의 안 쓰는 워크로드(0%)엔 아무 이득이 없다 — 이번 인하는 철저히 캐시 재사용형 작업을 위한 것이다.

스티커 비교의 함정

Fable 5.1을 다른 모델과 스티커로만 비교하면 $10/$50로 가장 비싸 보인다. 하지만 캐시 히트율 90%인 장기 에이전트 세션에서 실효 입력비는 $1.23 — Sonnet 5 스티커($2)보다도 낮게 내려간다(출력은 여전히 $50로 비싸니, 출력량이 많은 과제엔 이야기가 다르다).

  • 입력이 지배적인 과제(거대 코드베이스를 읽고 소량 수정): 캐시 인하 효과가 크다. Fable의 실효비가 스티커 인상보다 훨씬 유리해진다.
  • 출력이 지배적인 과제(대량 생성): 출력 $50는 그대로라 캐시 인하 효과가 희석된다. 이땐 출력 단가가 낮은 모델을 우선 후보로(보이지 않는 추론 토큰 청구서).

한국에서 — 계산은 같지만

캐시 단가는 시간 기반이 아니라 토큰 기반이라, 한국어 토큰세는 그대로 적용된다. 즉 한국어 컨텍스트가 많은 코드베이스라면 토큰이 더 붇고, 그만큼 캐시 인하의 절대 절감액도 커진다(붇은 토큰의 대부분이 캐시 히트로 처리되므로). 결제는 세전 USD·웹 기준이라 환율·부가세는 별도.

결정하려는 사람에게

  • 스티커가 안 바뀌었다고 "변동 없음"으로 넘기지 마라. 장기 에이전트 작업의 실제 비용은 캐시 읽기가 지배하고, 그게 4분의 1이 됐다.
  • 자기 워크로드의 캐시 히트율부터 확인하라. 80% 이상이면 이번 인하의 수혜가 크고, 낮으면 무관하다(API 예산 짜는 법).
  • 캐시 설계를 챙겨라. 가변 값(시각·사용자명)을 프롬프트 앞에 두면 캐시 미스가 나 이 인하가 무의미해진다 — 프리픽스 고정이 첫 수칙이다.
  • 입력/출력 비율로 모델을 골라라. 읽기 많은 과제는 Fable 5.1의 캐시 이점이, 쓰기 많은 과제는 출력 단가가 승부를 가른다(코딩 AI 결정 가이드).

참고

  • 출처: Anthropic 공식 changelog(2026-09-01, Fable 5.1·Mythos 5.1 출시) 본지 확인. "가격은 Fable 5와 동일($10/$50), 캐시 읽기 $0.25/MTok로 인하" 명시. 본지 claude-api.json 반영(cache_read $1.00→$0.25).
  • 실효 입력비 표는 실효 = (1−히트율)×$10 + 히트율×캐시읽기로 계산한 세전 추정이며, 캐시 쓰기 비용·출력·실제 히트율에 따라 달라진다. 모델 품질 비교는 본지 범위 밖이다.