claude-fable-5를 claude-fable-5-1로 바꾸면 첫 응답은 정상적으로 받을 수 있습니다. 하지만 이후 도구 라우터가 작동하지 않거나, 대화 기록을 수정하는 로직이 깨졌다는 사실을 발견할 수 있습니다. Fable 5.1은 장시간 실행되고 캐시를 많이 활용하는 작업의 기본 선택지로 더 적합하지만, 단순히 모델 ID만 바꾸면 끝나는 업그레이드는 아닙니다. 정가와 사용량 제한은 그대로지만 API 동작 세 가지가 달라집니다.
한눈에 보는 결론: 캐시를 활용하는 에이전트라면 업그레이드, 모든 요청에 적용할 필요는 없어
Claude Fable 5.1은 Claude Fable 5의 후속 모델로, Anthropic도 성능 향상을 위해 전환할 것을 권장하고 있습니다. 특히 대규모 프롬프트 앞부분을 에이전트가 반복해서 읽는 환경에서 차이가 큽니다. 캐시 읽기 요금이 100만 토큰당 $1에서 $0.25로 내려가지만, 일반 입력과 출력 요금은 각각 100만 토큰당 $10와 $50로 그대로입니다. (Anthropic의 Fable 5.1 개요)
| 워크로드가 다음과 같다면… | 우선 선택할 모델 | 이유 |
|---|---|---|
| 긴 시스템 프롬프트, 코드베이스, 문서 컨텍스트를 반복해서 재사용한다 | Fable 5.1 | 캐시 읽기 요금이 75% 저렴하고, Anthropic이 에이전트 작업에서 더 나은 결과를 보고했습니다. |
tool_choice: {"type":"any"} 같은 강제 도구 호출을 사용한다 | 전환 전에 Fable 5.1 테스트 | Fable 5.1은 강제 도구 선택을 400 오류로 거부합니다. |
| 이전 대화 턴을 수정하거나 다시 구성한다 | 대화 기록 계층을 수정할 때까지 Fable 5 유지 | Fable 5.1은 thinking 블록을 앞선 프롬프트, 도구, 대화 기록에 연결합니다. |
| 가장 낮은 일반 토큰 요금이 필요하다 | 두 Fable 모델 모두 제외 | 두 모델 모두 입력 100만 토큰당 $10, 출력 100만 토큰당 $50입니다. |
| 캐시를 사용하지 않는 일반 프롬프트를 안정적인 Fable 5 연동으로 처리한다 | 먼저 평가 실행 | 정가 기준 절감폭이 작을 수 있고, 벤치마크 향상폭도 작업에 따라 다릅니다. |
Fable 5에서 Fable 5.1로 바뀐 점
Claude Fable 5.1의 핵심 용량은 Claude Fable 5와 같습니다. 컨텍스트 윈도는 1-million-token, 최대 출력은 128,000토큰이며 적응형 thinking이 항상 활성화됩니다. 공식 문서에서 확인되는 차이는 수명 주기, 2026년 1월에서 2026년 6월로 바뀐 지식 기준일, 저렴해진 캐시 읽기 요금, 그리고 도구와 thinking 블록에 관한 새로운 API 동작입니다. (Fable 5 레거시 개요; Fable 5.1 모델 개요)
| 사양 | Claude Fable 5 | Claude Fable 5.1 |
|---|---|---|
| API 모델 ID | claude-fable-5 | claude-fable-5-1 |
| 수명 주기 | 활성, 레거시 | 활성, 최신 Fable 모델 |
| 출시일 | 2026년 6월 9일 | 2026년 9월 1일 |
| 컨텍스트 윈도 | 1M tokens | 1M tokens |
| 최대 출력 | 128K tokens | 128K tokens |
| Thinking | 적응형, 항상 활성화 | 적응형, 항상 활성화 |
| 기본 effort | High | High |
| 신뢰할 수 있는 지식 기준일 | 2026년 1월 | 2026년 6월 |
| 입력 / 출력 요금 | $10 / $50 per MTok | $10 / $50 per MTok |
| 캐시 읽기 요금 | $1 / MTok | $0.25 / MTok |
Fable 5.1은 Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, AWS의 Claude Platform에서 사용할 수 있습니다. Anthropic은 Fable 5도 같은 플랫폼군에서 제공되며, 2027년 6월 9일 이전에는 종료되지 않는다고 안내합니다. Fable 5.1 역시 2027년 9월 1일 이전에 종료될 예정은 없습니다. (Fable 5.1 제공 범위 및 수명 주기; Fable 5 제공 범위 및 수명 주기)
가격 차이는 정가가 아니라 캐시 읽기에서 난다
Fable 5.1은 새로 입력하거나 출력하는 토큰의 요금이 더 저렴한 모델이 아닙니다. Fable 5와 마찬가지로 입력은 100만 토큰당 $10, 출력은 100만 토큰당 $50이지만, 캐시 읽기는 100만 토큰당 $1에서 $0.25로 내려갑니다. (Anthropic 요금 문서)
| 사용 항목 | Fable 5 | Fable 5.1 | 변화 |
|---|---|---|---|
| 새 입력 | $10 / MTok | $10 / MTok | 없음 |
| 출력 | $50 / MTok | $50 / MTok | 없음 |
| 5분 캐시 쓰기 | $12.50 / MTok | $12.50 / MTok | 없음 |
| 1시간 캐시 쓰기 | $20 / MTok | $20 / MTok | 없음 |
| 캐시 읽기 | $1 / MTok | $0.25 / MTok | 75% 저렴 |
| 배치 입력 / 출력 | 50% 할인 | 50% 할인 | 공시 할인율 동일 |
간단한 예를 들어보겠습니다. 에이전트가 100만 토큰 분량의 프로젝트 컨텍스트를 캐시에서 10번 읽고, 출력으로 200,000토큰을 생성한다고 가정하겠습니다. 캐시 읽기 비용은 Fable 5에서 $10, Fable 5.1에서 $2.50입니다. 출력 비용은 두 모델 모두 $10입니다. 이 조건만 놓고 보면 총 토큰 비용은 $20에서 $12.50으로, 37.5% 줄어듭니다.
실제 절감액은 캐시 적중률, 캐시 쓰기, 출력 길이, 재시도, 도구 호출, 폴백 라우팅에 따라 달라집니다. Anthropic은 일반적인 워크로드에서 약 25%, 에이전트성이 높은 워크로드에서는 최대 약 45%의 비용 절감을 예상합니다. (Anthropic Fable 제품 페이지)
구독 플랜 사용량과 API 비용 구조는 별개입니다. Anthropic 고객지원 문서에 따르면 Fable 5와 Fable 5.1은 현재 동일한 플랜 정책을 따릅니다. Max와 프리미엄 Team 또는 레거시 Enterprise 좌석은 주간 사용량 한도의 최대 50%까지 Fable 모델을 사용할 수 있고, Pro와 일반 좌석은 종량제 사용 크레딧을 사용합니다. 기존 Fable 5 프로모션은 2026년 7월 19일 종료됐으며, Fable 5.1은 이 프로모션에 포함되지 않았습니다. (Anthropic 플랜 안내)
벤치마크는 분명한 향상을 보여주지만, 작업별 편차가 크다
Anthropic이 공개한 비교 결과에서 Fable 5.1은 여러 에이전트 및 컴퓨터 사용 평가에서 Fable 5를 앞섭니다. 다만 격차는 소폭부터 매우 큰 수준까지 다양합니다. 아래 수치는 버전별로 통제된 조건에서 진행한 공급업체 자체 평가 결과이므로 방향성을 파악하는 참고 자료로 보고, 실제 프롬프트로 별도 검증해야 합니다. (Anthropic 벤치마크 표)
| 벤치마크 | Fable 5.1 | Fable 5 | 차이 |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | +27.9포인트 |
| Terminal-Bench 4.0 | 55.8% | 42.0% | +13.8포인트 |
| GDPval-AA v2 | 1,853 Elo | 1,723 Elo | +130 Elo |
| OSWorld 2.0, partial | 77.9% | 72.9% | +5.0포인트 |
| OSWorld 2.0, strict | 41.7% | 36.1% | +5.6포인트 |
| Humanity’s Last Exam, no tools | 60.9% | 57.8% | +3.1포인트 |
| Humanity’s Last Exam, with tools | 65.0% | 63.8% | +1.2포인트 |
| AutomationBench | 31.4% | 17.1% | +14.3포인트 |
| CursorBench 3.2.0 | 73.4% | 70.5% | +2.9포인트 |
공개된 결과 중 가장 큰 격차는 Terminal-Bench-Science 0.1입니다. Fable 5.1의 보고 점수가 Fable 5의 두 배를 넘습니다. AutomationBench와 Terminal-Bench 4.0에서도 상승폭이 상당합니다. 반면 Humanity’s Last Exam과 CursorBench의 향상폭은 상대적으로 작습니다. 즉, Fable 5.1이 모든 종류의 작업에서 같은 폭으로 더 나은 것은 아닙니다.
Anthropic의 표에는 공개 버전 Fable 5.1의 Terminal-Bench 4.0 결과가 55.8%로 기재되어 있고, Mythos 5.1의 결과 60.9%는 별도로 보고됩니다. Mythos 5.1은 일반적으로 이용할 수 있는 Fable 5.1의 대체 모델이 아닙니다. (Anthropic 제품 페이지)
API 마이그레이션 전에 먼저 확인할 Fable 5 동작 세 가지
Anthropic은 Fable 5.1로의 마이그레이션이 대부분 드롭인 방식으로 가능하다고 설명합니다. 하지만 세 가지 변경점은 운영 환경에서 오류를 일으키거나 에이전트 동작을 조용히 바꿀 수 있습니다. 모든 환경에서 모델 ID를 바꾸기 전에 반드시 확인하세요. (Fable 5.1 마이그레이션 가이드)
1. 강제 도구 선택은 400 오류를 반환한다
Fable 5.1은 tool_choice: {"type":"auto"}와 tool_choice: {"type":"none"}을 지원합니다. 하지만 {"type":"any"}와 특정 도구를 지정하는 강제 호출은 400 invalid_request_error로 거부합니다. Messages API, Message Batches API, 토큰 수 계산 엔드포인트 모두 동일합니다.
애플리케이션에서 유효한 JSON이 필요하다면 지원되는 환경에서는 구조화된 출력을 사용하세요. 또는 도구 선택을 auto로 유지하면서 엄격한 스키마와 명시적인 지시를 함께 제공할 수 있습니다. 특정 턴에서 반드시 특정 도구를 호출해야 한다면 Anthropic은 해당 턴에만 적용되는 시스템 지시문을 뒤에 추가하는 방식을 대안으로 안내합니다.
2. Thinking 블록은 생성한 모델에 연결된다
Fable 5.1은 Fable 5와 호환되는 이전 Claude 모델에서 보존된 thinking 블록을 읽을 수 있습니다. 반대로 이전 모델은 Fable 5.1의 thinking 블록을 읽지 못합니다. 폴백 과정에서 대화가 이전 모델로 넘어가면 읽을 수 없는 블록은 API가 삭제하고, 폴백 모델은 다시 계획을 세워야 합니다.
삭제된 블록 자체는 입력 토큰으로 과금되지 않습니다. 다만 모델이 바뀐 뒤 계획을 새로 세우면서 지연 시간과 첫 턴 비용이 늘어날 수 있습니다. 디버깅이 필요하다면 Anthropic이 안내하는 thinking-binding-controls-2026-08-01 베타 헤더를 사용하세요. 이 헤더는 model_binding_mismatch 변환을 보고합니다.
3. 이전 대화 기록을 수정하면 요청이 무효화될 수 있다
새 API 계정에서는 보존된 thinking 블록 앞에 있는 시스템 프롬프트, 도구, 이전 메시지 기록이 변경됐는지 Fable 5.1이 확인합니다. 해당 앞부분을 수정하거나, 순서를 바꾸거나, 삭제하거나, 다시 구성하면 응답 대신 400 invalid-signature 오류가 반환될 수 있습니다.
가장 안전한 기본값은 기록을 뒤에만 추가하는 방식입니다. 대화 중간에 요약을 끼워 넣기보다 서버 측 압축이나 컨텍스트 편집 기능을 사용하고, 턴 사이에 공유하는 파일은 Files API의 file_id 또는 동일한 바이트를 사용해 안정적으로 유지하세요. 기존 클라이언트가 정확히 같은 프롬프트 앞부분을 보존한다면 모델 ID만 바꿔도 됩니다. 반면 매 턴마다 메시지를 다시 구성하는 클라이언트라면 먼저 어댑터를 추가해야 합니다.
추가된 기능도 활용할 만하다
Fable 5.1에는 전체 코드를 다시 작성하지 않고도 장시간 실행되는 에이전트를 개선할 수 있는 제어 기능도 추가됐습니다.
- 메시지별 effort: 캐시된 프롬프트 앞부분을 무효화하지 않고 이후 턴에서
low,medium,high,xhigh,max로 변경할 수 있습니다. - 턴 단위 시스템 메시지: 기존 시스템 프롬프트에서 텍스트를 삽입하고 삭제하지 않아도 한 턴에만 적용되는 지시를 추가할 수 있습니다.
- 진행 상황 업데이트: 문서에 안내된 표시 설정을 사용해 도구 호출 사이에 읽을 수 있는 진행 상황을 요청할 수 있습니다.
- 저렴해진 캐시 읽기 요금: 반복되는 프롬프트 앞부분은 유지하되, 마이그레이션 후 캐시 적중률을 다시 측정하세요.
effort 이름을 모델 간에 동일한 작업량 단위로 간주해서는 안 됩니다. 먼저 문서에 나온 기본값 high에서 시작한 뒤 실제 작업 세트로 medium과 그보다 높은 설정을 비교해 품질, 지연 시간, 총 토큰 수를 확인하세요.
접근 권한, 할당량, 폴백이 실제 결과를 바꿀 수 있다
Fable 5.1은 유료 Claude 플랜과 Anthropic API, 공식 지원 클라우드 플랫폼에서 폭넓게 사용할 수 있습니다. 하지만 플랜에서 사용할 수 있다는 말이 포함 사용량이 무제한이라는 뜻은 아닙니다. Pro 사용자와 일반 Team 좌석은 첫 요청부터 사용 크레딧이 필요할 수 있고, Max와 프리미엄 좌석은 주간 사용량 풀의 일부를 Fable 전용으로 공유합니다. Claude Code에서 Fable 5.1을 사용하려면 2.1.250 이상이 필요하며, Fable 5에는 2.1.170 이상이 필요합니다. (Anthropic 플랜 및 접근 가이드)
자동 전환 때문에 앱에서 진행한 Fable 비교 결과가 API에서와 다르게 보일 수도 있습니다. Anthropic에 따르면 민감한 사이버보안 및 생물학 요청은 Opus 폴백 모델로 라우팅될 수 있으며, Claude 서비스 화면에서는 자동 전환이 기본적으로 활성화돼 있습니다. API에서는 개발자가 폴백을 직접 설정해야 합니다. 폴백 처리를 추가하지 않으면 거부가 성공한 HTTP 응답으로 반환되고, stop reason에는 거부 사유가 표시됩니다. (Anthropic 폴백 안내)
초기 사용자 의견은 어디까지나 일화적 사례지만, 파일럿에서 다음 두 가지 비용을 측정해야 한다는 점은 보여줍니다.
“5.1은 괜찮은 것 같지만 확실히 더 느린 것 같다.” — u/BeowulfShaeffer, r/ClaudeAI 출시 토론
“벌써 사용량이 100%에 도달했다.” — u/noeyb, r/ClaudeAI 출시 토론
이 댓글만으로 일반적인 성능 경향을 확정할 수는 없습니다. 다만 답변 품질과 함께 실제 처리 시간과 할당량 소모량도 기록해야 한다는 점은 분명합니다.
Fable 5 사용자를 위한 선택 가이드
| 상황 | 실용적인 선택 |
|---|---|
| 컨텍스트를 반복해서 읽는 신규 에이전트 | Fable 5.1, 첫날부터 캐시 적중률과 지연 시간을 기록 |
| 추가만 가능한 대화 기록과 자동 도구를 사용하는 기존 Fable 5 에이전트 | 대표 작업 일부로 Fable 5.1 파일럿 진행 |
| 이름이 지정된 도구를 강제로 호출하는 기존 에이전트 | 도구 선택 로직부터 수정한 뒤 Fable 5.1 테스트 |
| 이전 메시지나 시스템 프롬프트를 다시 작성하는 기존 클라이언트 | 대화 기록 계층을 재설계하는 동안 Fable 5를 폴백으로 유지 |
| 대부분 새 프롬프트이고 캐시 재사용이 적다 | 토큰 요금만 보지 말고 작업 완료 비용 비교 |
| 사이버보안 또는 생물학 안전장치를 작동시킬 가능성이 높은 작업 | 마이그레이션 전에 폴백 경로와 Opus 요금을 모델링 |
| 더 낮은 일반 입력·출력 요금이 필요하다 | 다른 Anthropic 모델과 비교. Fable 5.1과 Fable 5의 정가는 동일하기 때문 |
마이그레이션 테스트는 작게 시작해도 됩니다. 대표 작업 20~50개를 다시 실행하고, 동일한 도구와 프롬프트를 고정한 뒤 성공률, 강제 도구 호출 오류, 폴백 횟수, 캐시 읽기 토큰, 총 입력·출력 토큰, 지연 시간, 할당량 소모량, 작업 완료 비용을 기록하세요. 품질 기준을 충족하면서도 호환성이나 할당량 문제가 감당할 수 없는 수준으로 늘어나지 않을 때 Fable 5.1을 정식 도입하면 됩니다.
구매자가 여전히 묻는 질문
Claude가 Fable 5.1에서 다른 모델로 전환한 이유는 무엇인가요?
안전장치 분류기가 일부 사이버보안, 생물학, 추론 추출, 최첨단 모델 개발 관련 요청을 감지하면 자동 폴백이 작동할 수 있습니다. Claude 앱에서는 요청이 Opus 모델에서 다시 실행될 수 있고, API에서는 개발자가 폴백 동작을 직접 설정해야 합니다. (Anthropic 폴백 안내)
Fable 5.1은 새로운 장기 작업 에이전트와 캐시를 많이 재사용하는 Fable 5 워크로드에 더 적합한 목표 모델입니다. 다만 연동 과정에서 도구를 강제 호출하거나, 메시지 기록을 수정하거나, 폴백과 할당량의 불확실성을 감수할 수 없다면 호환성 파일럿이 끝날 때까지 Fable 5를 유지하는 편이 안전합니다.