O Claude Opus 5 custa metade do Claude Fable 5 e, segundo os números de lançamento da própria Anthropic, fica a menos de 0,5% do melhor resultado do Fable 5 no CursorBench 3.2 usando esforço max.
Ele também supera o melhor resultado do Fable 5 no OSWorld 2.0 por cerca de um terço do custo por tarefa. Ambos são números divulgados pelo fornecedor e ainda não passaram por replicação independente. Mesmo assim, o Fable 5 segue custando o dobro em toda a tabela:
| Por milhão de tokens | Claude Fable 5 | Claude Opus 5 | Proporção |
|---|---|---|---|
| Entrada | $10 | $5 | 2.0x |
| Saída | $50 | $25 | 2.0x |
| Gravação de cache, 5 min | $12.50 | $6.25 | 2.0x |
| Leitura de cache | $1 | $0.50 | 2.0x |
| Batch API | $5 / $25 | $2.50 / $12.50 | 2.0x |
Valores conferidos na página de preços da Anthropic em 25 de julho de 2026. Portanto, a comparação entre Claude Opus 5 e Fable 5 se resume a uma pergunta: o que precisa ser verdade na sua carga de trabalho para justificar esses 2x?
A resposta curta, com as contas logo abaixo, é que o Fable 5 precisa acertar cerca de 60% mais do que o Opus 5. Na prática, o Opus 5 é a escolha padrão, e o Fable 5 fica para exceções.
O preço é 2.0x — mas há três situações que mudam a conta
Não some a inflação do tokenizador à diferença de preço. A visão geral dos modelos informa que o tokenizador do Fable 5, introduzido com o Opus 4.7, gera "aproximadamente 30% mais tokens" do que os modelos anteriores ao Opus 4.7. Como o Opus 5 também pertence à geração 4.7 ou posterior, ambos sofrem a mesma inflação. A diferença permanece em 2.0x, não 2.6x.
Há três preços que rompem essa proporção diretamente:
- O modo rápido do Opus 5 custa $10 / $50, a tarifa padrão do Fable 5. Com o mesmo gasto, a escolha passa a ser a capacidade do Fable 5 ou o Opus 5 com até aproximadamente 2.5x mais tokens de saída por segundo. Disponível apenas na Claude API.
- O Fable 5 na Batch API custa $5 / $25, o preço de tabela do Opus 5. Trabalhos tolerantes à latência podem usar o modelo de ponta pela tarifa síncrona padrão do modelo default. Batch contra batch, os 2x continuam valendo; trata-se de arbitragem de modalidade de cobrança, não de desconto.
- Leituras de cache do Fable 5 custam $1, contra $0.50 no Opus 5. A relação entre equivalentes segue em 2x, mas o Fable 5 lendo do cache custa um quinto do que o Opus 5 lendo uma entrada nova. Em loops intensivos em cache, isso reduz a diferença absoluta.
Nosso teste com quatro tarefas: menos tokens, custo maior
Executamos quatro tarefas com avaliação mecânica, uma vez para cada modelo, em 24 de julho de 2026: um bugfix com dois defeitos em kth_smallest, uma tarefa de esquema JSON estrito, uma questão de número de Frobenius — pacotes de 7 e 12, resposta 65 — e um refactor sem comentários com validação. Os dois modelos acertaram 4 de 4.
| Tarefa | Saída do Opus 5 | Saída do Fable 5 | Canal |
|---|---|---|---|
| Bugfix com dois defeitos | 36 tok / 4.52s | 69 tok / 5.61s | Claude Code |
| Esquema JSON estrito | 94 tok / 4.8s | 86 tok / 4.4s | Gateway |
| Número de Frobenius (65) | 407 tok / 6.8s | 358 tok / 7.3s | Gateway |
| Refactor, sem comentários | 429 tok / 6.93s | 251 tok / 8.09s | Claude Code |
| Total | 966 tok / 23.05s | 764 tok / 25.40s | |
| Custo de saída na tabela | $0.024 | $0.038 |
O Fable 5 gerou 21% menos tokens de saída, mas ainda custou cerca de 1.6x mais por execução, pois sua tarifa de saída é o dobro. O modelo mais barato foi o mais verboso, e a economia de tokens do Fable 5 recuperou menos da metade de seu próprio ágio.
A documentação classifica o Fable 5 como "Slower" e o Opus 5 como "Moderate". Neste teste, o Fable 5 também foi mais lento em três das quatro tarefas.
Esses números vêm com três ressalvas:
- Houve uma execução por par de modelo e tarefa, no esforço padrão, com pontuação mecânica. É um teste rápido, não um benchmark.
- Consideramos apenas tokens de saída, nas tarifas oficiais. Nosso gateway relatou contagens de tokens de prompt extremamente variáveis para o mesmo prompt; uma fatura real também inclui entrada e cache.
- Contagem de tokens acompanha a configuração de thinking, não a qualidade. O Opus 5 executa thinking por padrão no esforço
high; o thinking adaptativo sempre ativo do Fable 5 reduziu a intensidade nas duas tarefas curtas.
Os totais também combinam canais diferentes: em ambas as tarefas de código, o Fable 5 retornou uma conclusão vazia pelo nosso gateway compatível com OpenAI, três vezes seguidas. Por isso, essas linhas vieram do canal próprio Claude Code. Trata-se de uma falha de roteamento, não de uma conclusão sobre a capacidade de programação do Fable 5 — e vale checar a saúde do serviço se houver um relay na sua pilha.
Como calcular o ponto de equilíbrio
Preço por token não é a unidade certa. O que decide é o gasto esperado por tarefa concluída:
custo esperado por sucesso = custo por tentativa / taxa de sucesso na primeira tentativa
A fórmula já incorpora novas tentativas, pois o número esperado de tentativas com taxa de sucesso p é 1/p. Igualando os dois modelos e cancelando os termos compartilhados, Claude Opus 5 vs Fable 5 vira uma única desigualdade:
taxa_de_sucesso(Fable 5) / taxa_de_sucesso(Opus 5) >= custo_por_tentativa(Fable 5) / custo_por_tentativa(Opus 5)
O lado direito é 2.0 quando ambos os modelos emitem a mesma quantidade de tokens e 1.58 com nossa mistura medida de saídas. Use 1.6 como limiar operacional considerando apenas o custo de saída: o Fable 5 precisa acertar cerca de 60% mais do que o Opus 5 para compensar o ágio. Cargas de trabalho dominadas por entrada ou cache empurram o valor de volta para 2.0x.
| Se o Opus 5 resolve de primeira | O Fable 5 precisa resolver |
|---|---|
| 30% das vezes | 47% |
| 40% | 63% |
| 50% | 79% |
| 60% | 95% |
| 63% | 100% |
| 70% | inatingível |
As duas últimas linhas são decisivas. Quando o Opus 5 supera aproximadamente 63% de sucesso na primeira tentativa, nenhum ganho de capacidade torna o Fable 5 mais barato por resultado: ele não pode passar de 100%. Na relação geral de 2.0x, esse teto cai para 50%.
O argumento econômico do Fable 5, então, está nas tarefas em que o Opus 5 falha. É o mesmo motivo pelo qual o melhor modelo Claude para programação dentro de um orçamento fixo raramente é o que ocupa o topo da linha. O limiar depende de três premissas; quebrar qualquer uma delas favorece o Fable 5:
- As tentativas são independentes.
- Falhas são baratas de detectar.
- Uma falha não custa mais do que uma nova tentativa.
Há uma preocupação que essa matemática não cobre: pagar mais pelo modelo que será substituído antes. A página de descontinuação de modelos lista ambos como Active:
claude-fable-5será descontinuado "not sooner than June 9, 2027".claude-opus-5será descontinuado "not sooner than July 24, 2027".
A Anthropic avisa com pelo menos 60 dias de antecedência, e essas datas mínimas cobrem somente plataformas operadas pela Anthropic. Portanto, esta é uma decisão de custo por resultado, não uma aposta em qual modelo vai sobreviver.
Quando os 2x se pagam
Há três cenários que justificam o ágio:
- Falhas que não podem ser detectadas a baixo custo. Uma suíte de testes torna o
1/puma medida honesta; uma execução de oito horas que falha na sexta hora, não. Nesse caso, a conta inclui computação desperdiçada e o trabalho do engenheiro para reconstruir o contexto. É o cenário para o qual a Anthropic posiciona o Fable 5: "built for the most demanding reasoning and long-horizon agentic work." - Entregáveis que valem mais do que os tokens. A R&D World relata que a Stripe migrou uma base Ruby de 50 milhões de linhas em um dia. Nessa relação entre resultado e gasto, preço por token deixa de ser uma variável relevante.
- Capacidade garantida. O Priority Tier inclui Fable 5 e Opus 4.8, mas exclui o Opus 5; portanto, uma requisição que nomeie Opus 5 falha na validação nesse nível. Este é o único eixo em que os 2x compram algo que o modelo mais barato não oferece, e só vale para organizações que já possuem um compromisso contratado.
Quando não se paga — e dois bloqueios absolutos
Retenção zero de dados é uma barreira, não uma questão de preço. Fable 5 e Mythos 5 têm retenção de 30 dias como Covered Models designados e não estão disponíveis sob ZDR. Assim, uma organização com ZDR recebe 400 invalid_request_error em toda solicitação ao Fable 5, independentemente do orçamento. O Opus 5 não tem essa limitação.
Programação próxima de segurança oferece uma experiência pior pelo preço maior. Nas palavras da Anthropic, o classificador lançado com a restauração do Fable 5 "comes at the cost of flagging benign requests more often during routine coding and debugging tasks." Solicitações bloqueadas são redirecionadas para o Opus 4.8, e uma recusa no meio do streaming cobra a parte transmitida sem entregar resultado. Duas medições externas dimensionam esse custo:
- Detalhamento da R&D World sobre o Terminal-Bench: recusa de segurança em 20.9% dos testes, com nota 84.3 contra 88.0 do Mythos 5, ponderado de forma idêntica.
- Execução da CodeRabbit com 105 exemplos de revisão de código: 65 problemas acionáveis, contra 66 do Opus 4.8, com menor precisão.
Outros três custos ficam fora da tabela:
- Histórico de disponibilidade. O comunicado de reimplantação da Anthropic registra que ambos os modelos foram suspensos para todos os usuários de 12 de junho a 1º de julho de 2026: cerca de 18 dias sem acesso, após controles de exportação dos EUA "required us to restrict access to foreign nationals, whether inside or outside the United States."
- Trabalho de integração. Os documentos de lançamento orientam integradores do Fable 5 a planejar novo tratamento de recusas, novas tentativas de fallback em outro modelo Claude e novas regras de cobrança. O modelo de 1x não exige nada disso.
- Duas funções favorecem o modelo mais barato. O corte confiável de conhecimento do Opus 5 é maio de 2026, contra janeiro de 2026 no Fable 5, e alterações de ferramentas durante a conversa — beta
mid-conversation-tool-changes-2026-07-01— estão disponíveis a partir do Opus 5.
O lugar de Mythos 5 e Project Glasswing
A Anthropic ainda chama o Fable 5 de "Anthropic's most capable widely released model". O qualificativo widely released exclui o Claude Mythos 5 (claude-mythos-5), que tem as mesmas capacidades e o mesmo preço de $10 / $50.
O Mythos 5 é disponibilizado somente pelo Project Glasswing, uma oferta limitada de cibersegurança defensiva sem cadastro self-service. A diferença está nos classificadores e no acesso, não na capacidade: é o Fable 5 sem os classificadores de segurança, não um modelo mais forte.
Isso reorganiza o cenário de segurança. A Anthropic posiciona o Opus 5 abaixo do Mythos 5 em cibersegurança e biologia, e "far behind" em desenvolvimento de exploits, segundo dados do fornecedor. O Claude mais forte para trabalho de segurança é justamente o que não se pode comprar; já o disponível por 2x é aquele cujo classificador sinaliza debugging benigno. A comparação de Mythos 5 com Opus 4.8 cobre essa linhagem.
Como chamar cada modelo
IDs dos modelos e acesso
O Opus 5 é disponibilizado como claude-opus-5 e é o novo padrão do Claude Max. O Fable 5 é claude-fable-5 na mesma API, e ambos podem ser selecionados no Claude Code com /model. O Opus 5 funciona em:
- Claude API, claude.ai, Claude Code e Claude Cowork
- Amazon Bedrock, como
anthropic.claude-opus-5 - Google Cloud e Microsoft Foundry
Os dois têm janela de 1M de tokens e máximo de saída de 128k, então contexto não desempata a escolha. Nos planos de consumo, a franquia do Fable 5 migrou para créditos de uso após 7 de julho; assentos Enterprise padrão têm "no included Fable 5 allowance". Uma organização sem créditos, portanto, não tem acesso algum ao Fable 5.
O controle de gasto
Os controles de esforço e thinking são onde o custo realmente muda. O Opus 5 expõe de low a max, usa high por padrão e aceita thinking desativado em high ou abaixo. O thinking adaptativo do Fable 5 não pode ser desativado: há um piso estrutural nos tokens de saída, não um controle ajustável.
Se você roteia Claude por um gateway compatível com Anthropic, confira qual lado desta comparação ele oferece.
A AIReiter cobra $1.56 / $7.76 por MTok para o Opus 4.8, contra os $5 / $25 oficiais, cerca de 69% abaixo. Em 25 de julho, sua linha Claude terminava em Fable 5, Sonnet 5, Opus 4.8 e Opus 4.7, sem entrada para Opus 5 ainda.
A recomendação e a única exceção
Use o Opus 5 como padrão e trate o Fable 5 como uma escalada a ser justificada por classe de tarefa. A orientação da própria Anthropic concorda: "start with Claude Opus 5 for complex agentic coding and enterprise work. For workloads that need the highest available capability, use Claude Fable 5."
Dois casos mudam as premissas, em vez de superar o limiar:
- Execuções autônomas longas, nas quais uma falha silenciosa custa mais do que uma nova tentativa e
pdeixa de ser mensurável. - Qualquer trabalho assíncrono, pois o Fable 5 no Batch iguala o preço de tabela síncrono do Opus 5.
Uma exceção ignora a matemática em vez de satisfazê-la: o Priority Tier. Fable 5 e Opus 4.8 estão incluídos, enquanto Opus 5, Sonnet 5 e Mythos 5 são excluídos. Logo, uma carga que exija throughput com compromisso de 99.5% de uptime não pode comprar o lado barato por preço algum.
Leia isso de forma restrita. A Anthropic informa que esses compromissos de capacidade "are no longer available for purchase", e os titulares existentes os mantêm somente até o fim de seus contratos. Sem um contrato já em vigor, essa exceção está fechada e a matemática do ponto de equilíbrio continua válida.
Perguntas frequentes
O Opus 5 é melhor que o Fable 5?
O Opus 5 chega a menos de 0,5% do melhor resultado do Fable 5 no CursorBench 3.2 usando esforço max, pela metade do custo por tarefa. São dados do fornecedor, sem replicação independente. Seu corte de conhecimento também é mais recente: maio de 2026, contra janeiro de 2026.
O Fable 5 mantém o título de modelo amplamente lançado mais capaz e foi projetado para execuções agênticas de longo horizonte. A elegibilidade ao Priority Tier só ajuda organizações que já têm esse compromisso.
Por que o Fable 5 foi removido do Claude e ele voltou?
A Anthropic suspendeu ambos os modelos para todos os usuários de 12 de junho a 1º de julho de 2026, depois que controles de exportação dos EUA exigiram restringir o acesso de estrangeiros. O gatilho foi uma forma relatada externamente de levar o Fable 5 além de suas proteções para encontrar vulnerabilidades de software. O acesso foi restaurado com um classificador retreinado que bloqueia isso em mais de 99% dos casos, mas sinaliza solicitações benignas de programação com maior frequência.
O Claude Fable 5 é gratuito?
Não. Na API, ele custa $10 / $50 por milhão de tokens. Os planos de consumo o incluíam em até 50% dos limites semanais de uso até 7 de julho; depois disso, o acesso passou para créditos de uso, sem franquia nos assentos Enterprise padrão. Em volume, a rota mais barata é a Batch API, a $5 / $25.
O tokenizador do Fable 5 torna a diferença real de 2.6x?
Não. Os dois usam o tokenizador introduzido com o Opus 4.7, portanto a inflação de aproximadamente 30% vale em comparação com Sonnet 4.6 e anteriores, não entre estes dois. Por token, a diferença é 2.0x; em nossa amostra, o Fable 5 emitiu 21% menos tokens de saída, deixando a diferença por execução em cerca de 1.6x.
Qual é a diferença entre Fable 5 e Mythos 5?
Especificações idênticas e preço de $10 / $50. O Mythos 5 compartilha as capacidades do Fable 5 sem os classificadores de segurança e é disponibilizado somente pelo Project Glasswing, sem cadastro self-service. Ambos são Covered Models com retenção de 30 dias e ambos foram suspensos na mesma janela de junho.
Posso desativar o thinking do Fable 5 para reduzir a fatura?
Não. O thinking adaptativo do Fable 5 está sempre ativo, então seu piso de tokens de saída é estrutural. O Opus 5 aceita thinking: {"type": "disabled"} no esforço high ou abaixo e retorna 400 em xhigh e max. Assim, esforço funciona como controle de custo apenas no modelo mais barato.
O número para guardar
Uma proporção resolve a comparação entre Claude Opus 5 e Fable 5 para a maioria das classes de tarefa, e ela aponta para o Opus 5. A mesma matemática vale entre fornecedores; na comparação de Opus 5 com a família GPT-5.6, só as tarifas mudam.
- O ponto de equilíbrio é
taxa_de_sucesso(Fable 5) / taxa_de_sucesso(Opus 5) >= 1.6na sua carga de trabalho. Abaixo dessa linha, o Opus 5 com uma nova tentativa custa menos por tarefa concluída.
