Claude Opus 5는 Claude Fable 5의 절반 가격이다. Anthropic이 공개한 출시 수치만 놓고 봐도 max 노력 수준에서 Fable 5의 최고 CursorBench 3.2 점수와 0.5% 이내 차이까지 따라간다.
OSWorld 2.0에서도 Opus 5는 Fable 5의 최고 성적을 작업당 비용 약 3분의 1로 앞선다. 둘 다 벤더가 보고한 수치이며, 아직 독립 재현은 없다. 그런데도 Fable 5의 가격은 모든 항목에서 정확히 2배다.
| 토큰 100만 개당 | Claude Fable 5 | Claude Opus 5 | 비율 |
|---|---|---|---|
| 입력 | $10 | $5 | 2.0x |
| 출력 | $50 | $25 | 2.0x |
| 캐시 쓰기, 5분 | $12.50 | $6.25 | 2.0x |
| 캐시 읽기 | $1 | $0.50 | 2.0x |
| Batch API | $5 / $25 | $2.50 / $12.50 | 2.0x |
2026년 7월 25일 Anthropic 가격 페이지에서 확인했다. 결국 Claude Opus 5 vs Fable 5의 핵심은 하나다. 내 워크로드에서 Fable 5의 2배 가격은 언제 회수되는가?
아래 계산을 먼저 요약하면, Fable 5는 Opus 5보다 성공률이 약 60% 높아야 한다. 기본 선택은 Opus 5이고, Fable 5는 예외적인 선택지다.
2배 가격이 유지되는 조건과 무너지는 세 가지 지점
토크나이저 인플레이션을 요금 차이에 또 더하면 안 된다. 모델 개요에 따르면 Opus 4.7부터 도입된 Fable 5의 토크나이저는 Opus 4.7 이전 모델보다 토큰을 "약 30% 더" 생성한다. Opus 5 역시 4.7 이후 모델이므로 양쪽에 같은 인플레이션이 적용된다. 격차는 2.6배가 아니라 2.0배다.
다만 아래 세 가격 조건에서는 이 비율이 그대로 적용되지 않는다.
- Opus 5 fast mode는 $10 / $50으로, Fable 5의 기본 요금과 같다. 같은 비용이라면 Fable 5의 성능과 초당 출력 토큰이 최대 약 2.5배인 Opus 5 중 무엇을 택할지의 문제다. Claude API에서만 가능하다.
- Batch API의 Fable 5는 $5 / $25로, Opus 5의 정가와 같다. 지연 시간을 감수할 수 있는 작업이라면 최상위 모델을 기본 모델의 동기식 정가로 쓸 수 있다. Batch끼리 비교하면 여전히 2배이므로, 할인이라기보다 과금 방식의 차익이다.
- Fable 5의 캐시 읽기는 $1이고 Opus 5는 $0.50이다. 같은 조건의 비율은 2배지만, 캐시에서 읽는 Fable 5는 새 입력을 읽는 Opus 5 비용의 5분의 1이다. 캐시 비중이 큰 반복 작업에서는 절대 비용 차이가 줄어든다.
네 가지 작업에서 확인한 결과: 토큰은 적었지만 비용은 더 들었다
2026년 7월 24일, 모델별로 네 가지 기계 채점 작업을 각각 한 번 실행했다. 결함 두 개가 있는 kth_smallest 버그 수정, 엄격한 JSON 스키마 작업, 프로베니우스 수 문제(7과 12 묶음, 정답 65), 검증을 포함한 주석 없는 리팩터링이다. 두 모델 모두 4개 중 4개를 통과했다.
| 작업 | Opus 5 출력 | Fable 5 출력 | 채널 |
|---|---|---|---|
| 결함 2개 버그 수정 | 36 tok / 4.52s | 69 tok / 5.61s | Claude Code |
| 엄격한 JSON 스키마 | 94 tok / 4.8s | 86 tok / 4.4s | Gateway |
| 프로베니우스 수 (65) | 407 tok / 6.8s | 358 tok / 7.3s | Gateway |
| 리팩터링, 주석 없음 | 429 tok / 6.93s | 251 tok / 8.09s | Claude Code |
| 합계 | 966 tok / 23.05s | 764 tok / 25.40s | |
| 정가 기준 출력 비용 | $0.024 | $0.038 |
Fable 5는 출력 토큰을 21% 적게 썼지만 출력 단가가 2배라서 1회 실행 비용은 약 1.6배였다. 더 저렴한 모델이 오히려 더 길게 답했고, Fable 5의 토큰 절감분은 자체 프리미엄의 절반도 회수하지 못했다.
문서에서는 Fable 5의 속도를 "Slower", Opus 5를 "Moderate"로 표기한다. 이번 테스트에서도 Fable 5는 네 작업 중 세 작업에서 더 느렸다.
이 수치에는 세 가지 주의점이 있다.
- 기본 노력 수준에서 모델·작업 조합별로 한 번만 실행하고 기계적으로 채점했다. 벤치마크가 아니라 스모크 테스트다.
- 공식 요율 기준 출력 토큰만 계산했다. 같은 프롬프트에서도 게이트웨이가 보고한 프롬프트 토큰 수가 크게 달랐으므로, 실제 청구서에는 입력 및 캐시 비용이 추가된다.
- 토큰 수는 품질보다 thinking 설정을 반영한다. Opus 5는 기본적으로 노력 수준
high에서 thinking을 켜고 실행한다. Fable 5의 상시 adaptive thinking은 짧은 두 작업에서 규모를 줄였다.
합계에는 채널도 섞여 있다. Fable 5는 OpenAI 호환 게이트웨이를 통해 두 코드 작업에서 세 번 연속 빈 완료 응답을 반환했다. 따라서 해당 행은 Claude Code의 퍼스트파티 채널 결과다. 이는 Fable 5의 코딩 능력보다 라우팅 문제에 가깝다. 스택에 릴레이가 있다면 상태 점검이 필요하다.
손익분기점은 성공당 비용으로 계산한다
토큰 가격만으로는 판단할 수 없다. 중요한 것은 완료된 작업 하나당 기대 비용이다.
성공당 기대 비용 = 시도당 비용 / 첫 시도 성공률
성공률이 p일 때 성공까지 필요한 기대 시도 횟수는 1/p이므로, 이 식에는 재시도도 이미 반영돼 있다. 두 모델의 비용을 같게 놓고 공통 항을 지우면 Claude Opus 5 vs Fable 5는 다음 부등식 하나로 정리된다.
success_rate(Fable 5) / success_rate(Opus 5) >= cost_per_attempt(Fable 5) / cost_per_attempt(Opus 5)
두 모델이 같은 토큰 수를 출력한다면 우변은 2.0이다. 이번 측정의 출력 구성에서는 1.58이다. 출력 비용만 기준으로 실무 임계값을 1.6으로 잡을 수 있다. Fable 5는 프리미엄을 회수하려면 Opus 5보다 약 60% 더 자주 성공해야 한다. 입력 비중이나 캐시 비중이 높은 워크로드라면 이 수치는 다시 2.0배에 가까워진다.
| Opus 5가 첫 시도에 해결할 확률 | Fable 5에 필요한 해결 확률 |
|---|---|
| 30%의 경우 | 47% |
| 40%의 경우 | 63% |
| 50%의 경우 | 79% |
| 60%의 경우 | 95% |
| 63%의 경우 | 100% |
| 70%의 경우 | 도달 불가 |
판단을 가르는 것은 마지막 두 행이다. Opus 5의 첫 시도 성공률이 약 63%를 넘으면 Fable 5는 성공률을 아무리 높여도 결과당 비용이 더 저렴해질 수 없다. Fable 5의 성공률은 100%를 넘을 수 없기 때문이다. 일반적인 2.0배 비율이라면 이 상한은 50%까지 내려온다.
따라서 Fable 5의 경제성은 Opus 5가 실패하는 작업 안에만 존재한다. 이는 고정 예산에서 코딩에 가장 좋은 Claude 모델이 라인업 최상단 모델인 경우가 드문 이유와도 같다. 이 기준은 세 가지 가정 위에 서 있으며, 하나라도 깨지면 Fable 5 쪽으로 기운다.
- 시도들은 서로 독립적이다.
- 실패를 저렴하게 감지할 수 있다.
- 실패 비용은 재시도 비용보다 크지 않다.
이 계산에 담기지 않는 걱정은 프리미엄을 낸 모델이 먼저 대체될 가능성이다. 모델 지원 종료 페이지에서는 두 모델 모두 Active로 표시한다.
claude-fable-5의 종료 시점은 "not sooner than June 9, 2027"이다.claude-opus-5의 종료 시점은 "not sooner than July 24, 2027"이다.
Anthropic은 최소 60일 전에 공지하며, 이 최소 보장 시점은 Anthropic 운영 플랫폼에만 적용된다. 즉 살아남을 모델에 베팅하는 문제가 아니라 결과당 비용의 문제다.
2배를 내도 되는 세 가지 상황
프리미엄을 정당화할 수 있는 경우는 세 가지다.
- 실패를 싸게 알아낼 수 없는 작업. 테스트 스위트가 있다면
1/p계산은 정직하게 작동한다. 하지만 8시간 실행이 6시간째 실패한다면 얘기가 다르다. 낭비된 컴퓨팅 비용에 엔지니어가 상황을 복구하는 비용까지 더해진다. Anthropic이 Fable 5를 겨냥한 영역도 여기다. "가장 까다로운 추론 및 장기 에이전트 작업을 위해 설계됨"이라는 설명이다. - 산출물 가치가 토큰 비용을 압도하는 작업. R&D World는 Stripe가 5,000만 줄 규모의 Ruby 코드베이스를 하루 만에 마이그레이션했다고 보도했다. 결과 대비 비용의 비율이 이 정도라면 토큰당 가격은 더 이상 변수가 아니다.
- 보장된 용량이 필요한 경우. Priority Tier에는 Fable 5와 Opus 4.8이 포함되지만 Opus 5는 제외된다. 따라서 여기서 Opus 5를 지정한 요청은 검증에 실패한다. 2배를 내면 저렴한 모델이 제공할 수 없는 것을 사는 유일한 축이며, 이미 약정을 보유한 조직에만 해당한다.
2배가 의미 없는 곳과 두 가지 명확한 제약
Zero data retention은 가격이 아니라 장벽이다. Fable 5와 Mythos 5는 지정된 Covered Models로 30일 보존 정책을 적용받으며 ZDR에서는 사용할 수 없다. 따라서 ZDR 조직은 예산과 무관하게 모든 Fable 5 요청에서 400 invalid_request_error를 받는다. Opus 5에는 이런 제한이 없다.
보안 인접 코딩에서는 프리미엄을 내고도 경험이 나빠진다. Anthropic 표현에 따르면 Fable 5 복원과 함께 배포된 분류기는 "일상적인 코딩 및 디버깅 작업에서 무해한 요청을 더 자주 플래그하는 대가"를 치른다. 차단된 요청은 Opus 4.8로 라우팅되며, 스트리밍 도중 거부되면 일부 응답을 전송한 비용만 청구되고 결과물은 남지 않는다. 외부 측정 두 건은 이 비용을 수치로 보여준다.
- R&D World의 Terminal-Bench 분석: 시험의 20.9%에서 안전 거부가 발생했고, 동일 가중치의 Mythos 5는 88.0점인 데 비해 84.3점을 기록했다.
- CodeRabbit의 105개 예제 코드 리뷰 실행: Opus 4.8의 66건 대비 실행 가능한 이슈 65건을 찾았지만, 정밀도는 더 낮았다.
요율표 밖에 남는 비용도 세 가지다.
- 가용성 이력. Anthropic의 재배포 발표에 따르면, 두 모델은 미국 수출 통제로 인해 "미국 내외를 불문하고 외국 국적자의 접근을 제한해야 했기" 때문에 2026년 6월 12일부터 7월 1일까지 중단됐다. 모든 사용자가 약 18일간 접근할 수 없었다.
- 통합 작업. 출시 문서는 Fable 5를 호출하는 통합자에게 새로운 거부 처리, 다른 Claude 모델로의 폴백 재시도, 새 과금 규칙을 준비하라고 안내한다. 1배 모델에는 이런 요구가 없다.
- 두 기능은 오히려 Opus 5가 앞선다. Opus 5의 신뢰 가능한 지식 컷오프는 2026년 5월로 Fable 5의 2026년 1월보다 최신이다. 대화 중 도구 변경 기능도 베타
mid-conversation-tool-changes-2026-07-01부터 Opus 5 이상 모델에서 지원한다.
Mythos 5와 Project Glasswing의 위치
Anthropic은 여전히 Fable 5를 "Anthropic's most capable widely released model"이라고 부른다. 여기서 핵심은 widely released다. 동일한 성능과 같은 $10 / $50 가격의 Claude Mythos 5(claude-mythos-5)는 이 범주에서 제외된다.
Mythos 5는 셀프서비스 신청이 없는 제한적 방어 사이버보안 배포인 Project Glasswing을 통해서만 제공된다. 차이는 성능이 아니라 분류기와 접근 권한이다. Fable 5보다 강한 모델이 아니라 안전 분류기가 없는 Fable 5다.
이 구분은 보안 작업의 판단을 뒤집는다. Anthropic은 사이버보안과 생물학에서 Mythos 5가 Opus 5보다 앞서며, 익스플로잇 개발에서는 "far behind"라고 평가한다. 보안 작업에 가장 강한 Claude는 살 수 없는 모델이고, 2배를 내고 살 수 있는 모델은 무해한 디버깅까지 분류기가 플래그할 수 있는 모델이다. Opus 4.8과 비교한 Mythos 5 측정에서 이 계보를 다룬다.
각 모델 호출 방법
모델 ID와 접근 경로
Opus 5는 claude-opus-5로 제공되며 Claude Max의 새 기본 모델이다. Fable 5는 같은 API에서 claude-fable-5로 제공되고, Claude Code에서는 어느 모델이든 /model로 선택할 수 있다. Opus 5는 다음에서 실행된다.
- Claude API, claude.ai, Claude Code, Claude Cowork
- Amazon Bedrock의
anthropic.claude-opus-5 - Google Cloud 및 Microsoft Foundry
두 모델 모두 컨텍스트 창은 100만 토큰, 최대 출력은 128k이므로 컨텍스트는 선택 기준이 되지 않는다. 소비자 플랜에서 Fable 5 할당량은 7월 7일 이후 사용 크레딧으로 전환됐고, 일반 Enterprise 좌석에는 "no included Fable 5 allowance"가 적용된다. 크레딧이 없는 조직은 Fable 5에 아예 접근할 수 없다.
비용을 좌우하는 설정
비용 차이는 effort와 thinking 제어에서 나온다. Opus 5는 low부터 max까지 제공하고 기본값은 high다. high 이하에서는 thinking 비활성화도 받을 수 있다. 반면 Fable 5의 adaptive thinking은 완전히 끌 수 없다. 조절 가능한 다이얼이 아니라 출력 토큰의 구조적 하한이다.
Anthropic 호환 게이트웨이로 Claude를 라우팅한다면, 이 대결에서 어느 쪽 모델을 제공하는지 확인해야 한다.
AIReiter는 Opus 4.8을 MTok당 $1.56 / $7.76에 제공한다. 공식 $5 / $25보다 약 69% 낮다. 7월 25일 기준 Claude 라인업은 Fable 5, Sonnet 5, Opus 4.8, Opus 4.7까지이며 Opus 5 항목은 아직 없다.
권장 선택과 단 하나의 예외
기본값은 Opus 5로 두고, Fable 5는 작업 유형별로 근거를 갖춰 승격하는 모델로 보자. Anthropic의 자체 가이드도 같다. "복잡한 에이전트 코딩 및 엔터프라이즈 작업에는 Claude Opus 5로 시작하세요. 사용 가능한 최고 수준의 성능이 필요한 워크로드에는 Claude Fable 5를 사용하세요."
다음 두 경우는 임계값을 넘는다기보다 계산의 입력값 자체를 바꾼다.
- 조용한 실패 비용이 재시도보다 크고
p를 측정할 수 없게 되는 장시간 자율 실행. - Fable 5의 Batch 요금이 Opus 5의 동기식 정가와 같아지는 모든 비동기 작업.
계산을 충족하는 것이 아니라 무효화하는 예외는 하나다. Priority Tier에는 Fable 5와 Opus 4.8이 포함되지만 Opus 5, Sonnet 5, Mythos 5는 제외된다. 따라서 약정된 99.5% 가동 시간 처리량이 필요한 워크로드는 저렴한 쪽을 어떤 가격으로도 살 수 없다.
다만 이를 좁게 해석해야 한다. Anthropic은 해당 용량 약정이 "are no longer available for purchase"라고 밝힌다. 기존 보유자도 계약 종료일까지 유지할 뿐이다. 이미 보유한 약정이 없다면 이 예외는 닫혀 있으며, 손익분기점 계산은 그대로 유효하다.
FAQ
Opus 5가 Fable 5보다 좋은가요?
Opus 5는 max 노력 수준에서 Fable 5의 최고 CursorBench 3.2 점수와 0.5% 이내까지 접근하며, 작업당 비용은 절반이다. 이는 벤더 보고 수치로 독립 재현은 아직 없다. 지식 컷오프도 Fable 5의 2026년 1월보다 최신인 2026년 5월이다.
Fable 5는 가장 강력하게 널리 출시된 모델이라는 지위를 유지하며, 장기 에이전트 실행을 겨냥해 설계됐다. Priority Tier 자격은 이미 약정을 가진 조직에만 도움이 된다.
Fable 5는 왜 Claude에서 제거됐고, 지금은 돌아왔나요?
Anthropic은 미국 수출 통제로 외국 국적자의 접근을 제한해야 했던 뒤 2026년 6월 12일부터 7월 1일까지 두 모델을 모든 사용자에게 중단했다. 계기는 외부에서 보고된, Fable 5의 안전장치를 우회해 소프트웨어 취약점을 찾도록 프롬프트하는 방식이었다. 현재 접근은 복원됐다. 재학습된 분류기는 99% 이상 사례에서 이를 차단하지만, 무해한 코딩 요청도 더 자주 플래그한다.
Claude Fable 5는 무료인가요?
아니다. API 기준 토큰 100만 개당 $10 / $50이다. 소비자 플랜에서는 7월 7일까지 주간 사용 한도의 최대 50% 범위에서 포함됐지만, 이후 접근 방식은 사용 크레딧으로 바뀌었다. 일반 Enterprise 좌석에는 할당량이 없다. 대량 사용 시 가장 저렴한 경로는 $5 / $25의 Batch API다.
Fable 5의 토크나이저 때문에 실제 격차는 2.6배인가요?
아니다. 두 모델 모두 Opus 4.7에서 도입된 토크나이저를 사용한다. 약 30% 인플레이션은 Sonnet 4.6 및 이전 모델과 비교할 때의 이야기이지, 이 둘 사이의 차이가 아니다. 토큰당 격차는 2.0배이며, 이번 표본에서는 Fable 5가 출력 토큰을 21% 적게 생성해 실행당 격차가 약 1.6배가 됐다.
Fable 5와 Mythos 5의 차이는 무엇인가요?
사양과 $10 / $50 가격은 동일하다. Mythos 5는 안전 분류기 없이 Fable 5와 같은 성능을 제공하지만, 셀프서비스 신청이 없는 Project Glasswing을 통해서만 제공된다. 둘 다 30일 보존이 적용되는 Covered Models이며, 같은 6월 중단 기간을 겪었다.
비용을 줄이려고 Fable 5의 thinking을 끌 수 있나요?
불가능하다. Fable 5의 adaptive thinking은 항상 켜져 있으므로 출력 토큰 하한은 구조적으로 고정돼 있다. Opus 5는 노력 수준 high 이하에서 thinking: {"type": "disabled"}를 받을 수 있으며, xhigh와 max에서는 400을 반환한다. 따라서 effort를 비용 다이얼로 쓸 수 있는 것은 더 저렴한 모델뿐이다.
기억할 숫자 하나
대부분의 작업 유형에서 Claude Opus 5 vs Fable 5를 가르는 비율은 하나이며, 결론은 Opus 5 쪽이다. 이 계산은 벤더가 바뀌어도 그대로 적용된다. GPT-5.6 계열과 비교한 Opus 5에서는 요율만 달라진다.
- 내 워크로드에서
success_rate(Fable 5) / success_rate(Opus 5) >= 1.6일 때 손익분기점에 도달한다. 이 선 아래에서는 Opus 5에 재시도를 더한 편이 완료 작업당 비용이 낮다.
