Claude Fable 5.1 출시…캐시 읽기 75% 인하, API 이전 전 확인할 것
Anthropic이 Claude Fable 5.1을 출시했다. 입력·출력 단가는 유지하고 캐시 읽기만 75% 낮췄다. 제3자 성능·비용 측정과 유료 플랜, API 비호환 변경을 확인했다.
읽는 시간 약 8분
AI는 자료 조사와 초안 정리에 보조적으로 사용했으며, 편집부가 출처와 사실을 확인했습니다.
앤트로픽이 2026년 9월 1일 Claude Fable 5.1을 출시했다. 공식 발표와 모델 문서를 보면 Fable 5.1은 모든 유료 Claude 플랜과 API·주요 클라우드에서 이용할 수 있다. 같은 기반 모델인 Mythos 5.1은 검증된 사이버보안·생명과학 조직에만 제한 제공된다.
이번 출시를 “모델 가격 75% 인하”로 읽으면 안 된다. 입력과 출력 단가는 Fable 5와 같고, 반복해서 불러오는 캐시 입력의 읽기 단가만 75% 내려갔다. 성능 상한은 높아졌지만 실제 작업비가 줄어드는지는 캐시 적중률과 effort 설정, 출력 토큰 수에 달렸다.
Fable 5.1 출시와 함께 바뀐 것
| 항목 | 2026년 9월 2일 확인 내용 |
|---|---|
| 출시일 | 2026년 9월 1일 |
| Claude API 모델 ID | claude-fable-5-1 |
| 컨텍스트·최대 출력 | 100만 토큰·12만 8천 토큰 |
| 표준 입력·출력 가격 | 100만 토큰당 10달러·50달러 |
| 5분·1시간 캐시 쓰기 | 100만 토큰당 12.50달러·20달러 |
| 캐시 읽기 | 100만 토큰당 0.25달러, Fable 5보다 75% 인하 |
| 앱 이용 | Pro·Max·Team·Enterprise 등 모든 유료 플랜 |
| API·클라우드 | Claude API, Amazon Bedrock·Claude Platform on AWS, Google Cloud, Microsoft Foundry |
| 기본 데이터 보존 | 프롬프트·응답 최소 30일, 안전 조사·법적 보존은 예외 |
Claude 요금제 도움말에 따르면 Free 플랜에는 Fable 5.1이 없다. Max와 Team·레거시 Enterprise 프리미엄 좌석은 주간 사용량 한도의 최대 50%까지 Fable 모델을 쓸 수 있다. 한도가 50% 늘어나는 것이 아니라 같은 주간 한도에서 차감된다. Pro와 표준 좌석은 처음부터 사용량 크레딧으로 과금된다. Claude Code에서는 2.1.250 이상이 필요하다.
표의 API 가격은 표준 요율이다. Fable 제품 페이지에 따르면 미국 내에서만 추론하는 옵션은 입력·출력에 1.1배 요율을 적용한다.
앤트로픽은 캐시 인하로 일반적인 사용 패턴의 총비용이 약 25%, 캐시 비중이 큰 에이전트 작업은 최대 약 45% 줄 수 있다고 추산했다. 이 수치는 2026년 8월 실제 사용량을 기본 노력 수준에서 4주간 분석한 회사 측 추정치다. 짧은 일회성 요청이나 출력 토큰이 많은 작업에 그대로 적용되는 정액 할인율은 아니다.
최고 성능 기록과 실제 비용은 같은 얘기가 아니다
앤트로픽 평가에서 Fable 5.1은 과학 연구형 에이전트 벤치마크인 Terminal-Bench-Science 0.1에서 52.6%를 기록했다. Fable 5의 24.7%보다 두 배 이상 높다. 다만 이는 Claude Code --bare와 max effort로 70개 과제를 10회씩, 총 700회 실행한 앤트로픽의 재측정 결과이며 모델별 표준오차는 ±3.5~4.5%p다. 9월 2일 현재 벤치마크 공식 공개 리더보드에는 아직 Fable 5.1 결과가 없어 독립 재현을 기다려야 한다.
제3자 측정도 성능 향상과 비용 절감을 따로 봐야 한다는 점을 보여준다. Artificial Analysis의 사전 평가에서 Fable 5.1 max는 자체 Intelligence Index 66으로 측정 모델 가운데 가장 높았다. 그러나 이 지수를 구성하는 평가 과제당 평균 비용은 3.76달러로 Fable 5 max의 3.14달러보다 20% 높았다. 출력 토큰을 약 1.7배 더 쓴 영향이 캐시 할인을 상쇄했다. 이 평가에서는 안전 필터가 걸린 요청이 다른 Opus 모델로 넘어가 전체 출력 토큰의 약 4%를 처리했다는 조건도 붙는다.
반대로 CursorBench 3.2에서는 Fable 5.1 max가 73.4%, 평가 과제당 평균 9.64달러를 기록해 Fable 5 max의 70.5%, 17.32달러보다 점수는 높고 비용은 낮았다. 이 비용은 각 모델이 쓴 토큰에 공개된 입력·출력·캐시 단가를 적용한 값이다. Cursor도 작은 점수 차이는 통계적으로 유의하지 않을 수 있다고 밝힌다. 같은 모델이라도 평가 과제가 달라지면 더 싸기도, 더 비싸기도 한다. 팀의 실제 코드와 도구 호출 구조로 재야 비용 결론을 낼 수 있다.
API는 모델 이름만 바꾸면 오류가 날 수 있다
Fable 5에서 5.1로 옮기는 작업은 모델 ID 교체로 끝나지 않는다. 공식 변경 문서는 세 가지 비호환 변경을 먼저 확인하라고 안내한다.
tool_choice를any또는 특정 도구로 강제하면 400 오류가 난다.auto와none은 계속 쓸 수 있다.- Fable 5.1은 이전 모델의 thinking block을 읽지만, 이전 모델은 Fable 5.1의 thinking block을 읽지 못한다. 구형 모델로 전환할 때 API가 읽을 수 없는 블록을 제거하며, 기본 설정에서는 이 처리가 조용히 이뤄진다. 베타 헤더를 쓰면
input_transformations에서 확인할 수 있고 제거된 블록은 과금되지 않는다. - Fable 5.1 thinking block 앞의 시스템 프롬프트, 도구 목록, 과거 메시지를 수정하면 블록이 무효가 된다. 이 검사는 2026년 8월 31일 이후 만든 계정부터 강제로 적용된다. 기존 계정은 현재 불일치를 기록하며, 베타의
prefix_mismatch_behavior를 설정한 요청에서만 후속 동작을 수행한다.
직접 대화 배열을 만드는 앱은 계정 생성 시점과 관계없이 기록을 append-only로 다루는 편이 안전하다. 다음 제한은 Fable 5와 같다. Adaptive thinking은 항상 켜져 있고, 이를 끄거나 고정 budget_tokens를 주는 설정, assistant prefill, 기본값이 아닌 temperature·top_p·top_k는 400 오류를 낸다. 구조화된 출력을 위해 특정 도구 호출을 강제했다면 strict: true 도구 스키마나 structured outputs로 바꾸고 회귀 테스트를 먼저 돌리는 편이 안전하다.
안전 필터는 줄었지만 사라지지 않았다
Fable 5.1은 방어 목적의 소프트웨어 취약점 발견을 허용한다. 앤트로픽은 새 사이버보안 필터가 Fable 5에 적용되던 이전 필터보다 Claude Code 세션당 개입을 평균 약 60% 줄였다고 밝혔다. 회사 내부 측정이며 모든 저장소에서 같은 비율을 보장하지 않는다.
Fable 5.1의 안전장치는 침투 테스트, 익스플로잇 생성, 바이너리 기반 취약점 스캔을 계속 차단한다. API에서는 차단도 HTTP 오류가 아닌 stop_reason: "refusal" 응답으로 올 수 있다. 허용 가능한 범주의 응답을 다른 모델에서 이어가려면 별도 폴백을 구성해야 하며, 권장 폴백이 없는 범주는 거절로 끝난다. “Mythos와 같은 기반 모델”이라는 설명을 “안전장치 없는 일반 공개 모델”로 해석하면 안 되는 이유다.
텍스트 출력에는 통계적 워터마크도 들어간다. 숨은 문자나 사용자 정보를 넣는 방식은 아니며, 단어 선택의 통계적 패턴을 남기는 구조다. 탐지 API는 현재 자격을 갖춘 기관과 기업을 대상으로 비공개 미리보기 중이다.
Covered Models 정책에 따르면 프롬프트와 응답은 기본적으로 최소 30일 보존된 뒤 자동 삭제된다. 다만 안전 조사 대상이거나 법적으로 보존해야 하는 데이터는 예외다. 올가을 단계적으로 도입되는 Enterprise Frontier Safeguards는 모니터링 데이터를 고객이 통제하는 클라우드에 두는 방식이다. 전환 기간의 제로 데이터 보존은 자격이 확인된 조직에만 한시 제공되며 별도로 심사를 요청할 수도 있다. 민감한 코드나 문서를 다룬다면 모델 선택 화면이 보이는지만 확인해서는 부족하다.
한국 개발팀이 지금 확인할 것
앤트로픽의 모델 문서도 대부분의 업무에는 먼저 입력·출력 단가가 절반인 Opus 5를 쓰라고 권한다. Opus 5를 높은 effort로 실행해도 부족한 장기 코딩·다단계 리서치·복합 문서 작업이 Fable 5.1의 우선 대상이다.
도입 전에는 같은 업무를 Fable 5, Opus 5, Fable 5.1의 high와 max로 나눠 비교할 만하다. 성공률뿐 아니라 캐시 읽기 비중, 출력 토큰, 전체 소요 시간, 폴백·거절 횟수를 함께 남겨야 한다. 최고 점수만 보고 max를 기본값으로 두면 캐시에서 아낀 비용을 긴 출력이 다시 가져갈 수 있다.
기존 Fable 5의 한국 이용 조건과 요금제별 차이는 Claude Fable 5 한국 이용 가이드에서 이어서 확인할 수 있다. 실제 저장소 과제를 고정해 모델을 비교하는 방법은 AI 코딩 도구 저장소 테스트 기록과 같다.
Fable 5.1은 장기 에이전트의 성능 상한을 올렸고 반복 컨텍스트의 가격도 낮췄다. 하지만 모든 요청의 새 기본 모델은 아니다. 이번 출시에서 개발팀이 먼저 볼 숫자는 75%라는 홍보 문구가 아니라, 자기 워크로드의 캐시 적중률과 effort별 총비용이다.
참고한 출처
공식 출처와 보조 신호를 함께 확인했습니다. 전체 12개 중 공식 출처는 9개입니다.
- Claude Fable 5.1 and Mythos 5.1(새 창)공식Anthropic
- Claude Fable 5.1 overview(새 창)공식Claude Platform Docs
- What's new in Claude Fable 5.1(새 창)공식Claude Platform Docs
- Claude Fable models on your plan(새 창)공식Claude Help Center
- Claude Fable product page(새 창)공식Anthropic
- Covered Models(새 창)공식Claude Help Center
- Claude Mythos product page(새 창)공식Anthropic
- Refusals and fallback(새 창)공식Claude Platform Docs
- Claude text watermark(새 창)공식Anthropic
- Terminal-Bench-Science 0.1 leaderboard(새 창)보조Terminal-Bench-Science
- Claude Fable 5.1 tops the Intelligence Index(새 창)보조Artificial Analysis
- CursorBench 3.2(새 창)보조Cursor