AIREITER
API 문서가격
템플릿
  • AIReiter
  • 블로그
  • Claude Fable 5 high vs max: 어떤 effort를 써야 할까

Claude Fable 5 high vs max: 어떤 effort를 써야 할까

마지막 업데이트: 2026-07-29 10:56:35

Claude Fable 5 high와 max 중 무엇을 써야 할지 고민 중이라면, 결론은 비교적 간단하다. 거의 모든 작업은 high에 두고, 난도가 높은 코딩이나 에이전트 작업에서만 xhigh로 올리면 된다. max는 최후의 수단에 가깝다. 대부분의 작업에서 max는 비용이 약 두 배까지 늘어나는 반면 품질 향상은 체감하거나 측정하기 어렵고, 오히려 과도하게 생각하는 경우도 있다. 특히 놓치기 쉬운 점은 high와 max 사이에 xhigh가 있다는 것이다. effort를 높여야 하나 고민될 때, 실제 답은 대개 max가 아니라 xhigh다.

Fable 5에서 effort 설정이 바꾸는 것

Effort(output_config.effort)는 low, medium, high, xhigh, max의 다섯 단계로 제공된다. Fable 5의 기본값은 high이며, Anthropic의 effort 문서에 따르면 high를 명시하는 것은 이 파라미터를 아예 생략하는 것과 동일하다.

여기에는 의외로 중요한 두 가지가 있다. 우선 effort는 단순히 생각의 깊이만 조절하는 다이얼이 아니다. 화면에 보이는 응답 텍스트, 확장 사고, 에이전트 루프의 도구 호출까지 전체 토큰 사용량을 좌우한다. 낮은 effort에서는 도구 호출 횟수가 줄고 더 통합적으로 실행되며, 사전 설명과 확인 응답도 짧아진다. 반대로 높은 effort에서는 호출과 계획 설명이 늘고 최종 요약도 길어진다. 또 Fable 5의 thinking은 항상 활성화되어 있어 끌 수 없다(thinking: {type: "disabled"}를 지정하면 오류가 난다). 즉 thinking의 깊이는 effort로 제어해야 한다. high, xhigh, max에서는 Claude가 거의 항상 깊게 사고하고, low와 medium에서는 쉬운 문제라면 사고 단계를 건너뛸 수 있다.

high와 max 사이에는 xhigh가 있다

실제로는 ‘high vs max’의 이분법이 아니다. 그 사이에 추론량과 지연 시간의 균형을 더 세밀하게 조절하는 xhigh가 있다. Anthropic 엔지니어 Boris Cherny도 이를 “high와 max 사이의 새 단계”라고 설명했다. xhigh는 Fable 5, Mythos 5, Opus 4.8, Opus 4.7, Sonnet 5에서만 쓸 수 있다. Opus 4.6이나 Sonnet 4.6 같은 이전 모델은 high에서 바로 max로 넘어간다.

Anthropic이 각 단계에 제시한 용도는 다음과 같다.

단계Anthropic이 제시한 용도
low서브에이전트처럼 속도와 최저 비용이 중요한 단순 작업
medium속도, 비용, 성능의 균형이 필요한 에이전트 작업
high복잡한 추론, 어려운 코딩, 에이전트 작업(기본값)
xhigh30분 이상 장시간 실행되는 에이전트·코딩 작업, 수백만 단위 토큰 예산
max가장 깊은 추론, 내부 effort 제한 없음(출력은 여전히 max_tokens로 제한)

따라서 Fable 5를 max로 돌릴지 묻기 전에 먼저 확인할 것은 하나다. xhigh는 이미 써봤는가? 가장 어려운 코딩 및 에이전트 작업에서 권장되는 상향 단계는 max가 아니라 xhigh다.

비용과 지연 시간의 대가

Effort를 올린다고 토큰당 단가가 올라가지는 않는다. Fable 5는 모든 단계에서 입력 토큰 100만 개당 $10, 출력 토큰 100만 개당 $50의 고정 요금을 적용한다. 비용이 커지는 이유는 모델이 더 많은 토큰을 생성하기 때문이다.

low부터 max까지 Claude Fable 5 effort 단계별 작업당 상대 비용과 상대 출력 품질을 비교한 막대 차트. 비용은 가파르게 증가하지만 품질은 평탄해지는 모습을 보여 준다

이 차트는 실측 벤치마크가 아니라 아래에서 설명하는 상충 관계의 형태를 보여 주는 예시다. 양쪽 축에서 max를 1.0으로 정규화했다. 품질은 high에서 이미 상한에 가까워지지만, 비용은 단계를 올릴수록 계속 대략 두 배씩 증가한다.

계산이 특히 불리해지는 구간은 xhigh에서 max로 갈 때다. 소프트웨어 엔지니어 Ishu Agarwal은 2026년 7월 11일 공유한 내용에서 high → xhigh의 품질 향상은 “대개 3% 미만”인 반면 비용은 “30%에서 100%” 늘 수 있으며, effort가 높아질수록 모델이 “과도하게 생각하는” 경향이 있다고 말했다. 7월 14일 널리 공유된 게시물은 Fable 5가 max와 xhigh에서 “89.0 대 89.0”으로 같은 점수를 기록했고, 비용은 약 두 배였다고 주장했다. 이는 통제된 벤치마크가 아닌 커뮤니티 자료이므로 방향성을 보는 정도로 받아들여야 한다. 다만 max는 “상대적으로 작은 품질 향상에 비해 상당한 비용을 추가하며, 일부 구조화된 출력이나 지능 민감도가 낮은 작업에서는 과도한 사고를 유발할 수 있다”는 Anthropic의 설명과 방향은 일치한다.

지연 시간도 비슷하게 움직인다. 제품 관리자 Pawel Huryn은 2026년 6월 11일 effort 단계를 테스트한 뒤, “max 미만에서는 완료 시간이 거의 움직이지 않지만” 실제 작업에서는 “xhigh부터 완료 시간이 급증한다”고 밝혔다. 또 하나의 함정도 있다. 최신 Opus 세대와 토크나이저를 공유하는 Fable 5는 동일한 텍스트에서도 이전 Claude 모델보다 토큰 수가 최대 약 35% 높게 나올 수 있다. 이전 모델을 기준으로 잡은 비용 추정치는 낮게 보일 수 있다는 뜻이다.

high, xhigh, max 선택 기준

작업권장 effort상향할 시점
일상적인 코딩, 채팅, 추출, 서브에이전트low / medium출력 품질 저하가 눈에 띌 때
대부분의 추론, 일반적인 코딩, 에이전트 작업high (기본값)어려운 작업이 막히거나 더 깊은 계획이 필요할 때
가장 어려운 코딩·에이전트 작업, 장기 실행, 많은 도구 사용xhighxhigh로도 실제로 해결하지 못할 때
최첨단 수준의 문제, 또는 xhigh가 풀지 못한 버그. 비용보다 정확성이 중요할 때max(최상위 단계)

품질과 토큰 효율의 균형점은 high다. 가장 어려운 작업에는 xhigh가 실제로 추가적인 숙고를 제공한다. max는 xhigh가 이미 실패한 문제를 해결할 수 있을지 기대해 보는 단계에 가깝다. 오히려 effort를 낮추는 편이 더 현명한 경우도 많다. Anthropic에 따르면 Fable 5는 낮은 effort에서도 좋은 성능을 내며, “이전 모델의 xhigh 성능을 능가하는” 경우가 흔하다. CTO Morgan Linton도 직설적으로 말했듯, “코딩 관점에서 내가 하는 일의 약 95%는 Fable 5 Low와 Medium만으로 충분하다.” Low나 Medium이 같은 결과를 내는데 모든 작업을 high로 실행하면 플랜 한도만 빠르게 소진한다.

애초에 작업에 맞지 않는 모델을 고른 것이라면 effort 조정으로 해결할 수 없다. 그것은 effort가 아니라 모델 선택의 문제다.

Fable 5 effort에서 흔히 하는 오해 3가지

높은 effort가 더 똑똑한 모델을 뜻하지는 않는다. Effort는 Claude가 답하기 전 얼마나 많은 작업을 할지, 즉 생각과 도구 호출을 얼마나 할지를 정한다. 모델 자체의 능력을 바꾸는 기능은 아니다. low 응답과 max 응답은 같은 모델에서 나온다. 작업이 모델의 역량 밖이라면 max는 같은 결론에 도달하는 데 토큰만 더 쓴다.

Claude Code의 기본값과 API 기본값은 다르다. Claude Code의 기본값은 xhigh이고 API의 기본값은 high다. 같은 모델인데 환경에 따라 왜 다르게 행동하는지 의아했다면, 상당수는 이 차이로 설명된다. Claude Code에서 더 꼼꼼하고 비싸게 느껴지는 것은 기본 effort가 더 높기 때문이다. API에서도 같은 동작을 원한다면 xhigh를 명시적으로 설정하면 된다.

ultracode는 effort 단계가 아니다. Claude Code 메뉴에는 표시되지만 API가 허용하는 값은 low부터 max까지다. Ultracode는 xhigh에 멀티에이전트 워크플로를 실행할 수 있는 상시 권한을 결합한 기능이다. 토큰 소모가 크며 API에 전달할 수 있는 값도 아니다.

effort 설정 방법과 max_tokens 주의점

Effort는 output_config에 지정하며 베타 헤더는 필요 없다. Fable 5의 thinking은 항상 켜져 있으므로 thinking 파라미터는 아예 생략해야 한다.

import anthropic

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-fable-5",
    max_tokens=64000,          # give room at xhigh/max (see note below)
    output_config={"effort": "xhigh"},   # low | medium | high | xhigh | max
    messages=[{"role": "user", "content": "Refactor this module and add tests."}],
)

max_tokens는 thinking과 응답 텍스트를 합친 전체 출력의 하드 상한이다. xhigh나 max에서는 thinking이 이 예산의 상당 부분을 쓸 수 있다. 따라서 응답이 사고 도중 잘려 나가지 않도록 넉넉하게 설정해야 하며, 약 64,000부터 시작하는 것이 좋다. Fable 5는 100만 토큰 컨텍스트와 128K 출력 토큰을 지원한다.

FAQ

Fable 5의 high와 max effort는 무엇이 다른가?

기본값인 high는 뛰어난 결과를 내는 데 필요한 만큼만 리소스를 사용한다. max는 가장 깊은 추론을 위해 내부 제한을 없앤다. 다만 high에서 의미 있게 올리는 단계는 대개 그 사이에 있는 xhigh다.

Fable 5에서 max effort는 쓸 만한가?

드문 경우에만 그렇다. xhigh보다 비용이 약 두 배로 늘어나는 데 비해 측정 가능한 이득은 작고, 과도하게 생각할 수도 있다. 최첨단 수준의 문제나 xhigh가 해결하지 못한 버그에만 남겨 두는 편이 좋다.

effort 단계는 어떻게 바꾸나?

output_config: {"effort": "..."}에 low, medium, high, xhigh, max 중 하나를 설정하면 된다. Claude Code에서는 effort 메뉴를 사용한다.

기본 effort 단계는 무엇인가?

API에서는 high다. 파라미터를 생략하는 것과 동일하다. Claude Code의 기본값은 xhigh다.

effort가 높으면 토큰당 비용도 올라가나?

아니다. 토큰당 요금은 고정이다. 높은 effort에서 비용이 커지는 이유는 모델이 더 많은 토큰을 생성하기 때문이다.

Fable 5의 effort는 Sonnet이나 Opus의 effort 단계와 같은가?

파라미터와 단계 이름은 같지만, xhigh는 Fable 5, Mythos 5, Opus 4.8, Opus 4.7, Sonnet 5에서만 제공된다. 모델별 권장 기본값도 다르다. 둘 중 어떤 모델을 선택할지 고민 중이라면 Sonnet 5 versus Fable 5를 참고하면 된다.

>_AIReiter 모델 디렉터리

이 가이드와 관련된 모델로 빠르게 API 접근

Claude Fable 5

Chat

심층 추론과 복잡한 장문 작업을 위한 프리미엄 Claude 모델입니다.

AnthropicAPI Key 생성 >

Claude Sonnet 5

Chat

고급 추론, 코딩, 일상 업무를 위한 균형 잡힌 Claude 모델입니다.

AnthropicAPI Key 생성 >

GPT-5.6 Sol

Chat

까다로운 코딩, 추론, 장문형 에이전트 작업을 위한 프리미엄 GPT-5.6 텍스트 모델.

OpenAIAPI Key 생성 >

Gemini 3.1 Pro

Chat
GoogleAPI Key 생성 >

Claude Sonnet 4.6

Chat
AnthropicAPI Key 생성 >

최근 게시글

GPT-6 Astra API 리뷰(2026): 에이전트용이지, 무조건 교체용은 아니다

2026-09-07

Kling API 연동 가이드: 공식 API와 애그리게이터 비교 (2026)

2026-09-07

Suno API Key 발급 방법과 비용 정리 (2026)

2026-09-07

GPT-6 Astra 리뷰: API 요금 $10/$50, 값어치가 있을까?

2026-09-06
AIREITER

문의가 있으신가요? 연락처
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

AI 비디오

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

AI 이미지

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

블로그

모두 보기 →

회사

개인정보 처리방침서비스 약관환불 정책

© 2026 AIReiter. All rights reserved.