Trocar claude-fable-5 por claude-fable-5-1 pode funcionar na primeira resposta e, ainda assim, quebrar o roteador de ferramentas ou o histórico mutável da conversa. O Fable 5.1 é a melhor escolha padrão para cargas de trabalho longas e com muito uso de cache, mas não é um substituto totalmente transparente: os preços de tabela e os limites continuam iguais, enquanto três comportamentos da API mudaram.
Resposta curta: faça o upgrade em agentes com cache, não em toda requisição
O Claude Fable 5.1 é o sucessor atual do Claude Fable 5, e a documentação da Anthropic recomenda migrar para ele em busca de melhor desempenho. A vantagem aparece principalmente em agentes que leem repetidamente um prefixo grande de prompt: as leituras de cache caem de US$ 1 para US$ 0,25 por milhão de tokens, enquanto as tarifas padrão de entrada e saída permanecem em US$ 10 e US$ 50 por milhão de tokens. (Visão geral do Fable 5.1 na Anthropic)
| Se sua carga de trabalho… | Comece com… | Por quê |
|---|---|---|
| Reutiliza um prompt de sistema longo, uma base de código ou o contexto de um documento | Fable 5.1 | As leituras de cache custam 75% menos, e a Anthropic relata resultados mais fortes em tarefas agênticas. |
Usa chamadas de ferramenta forçadas, como tool_choice: {"type":"any"} | Teste o Fable 5.1 antes de trocar | O Fable 5.1 rejeita a seleção forçada de ferramentas com um erro 400. |
| Edita ou reconstrói turnos anteriores da conversa | Mantenha o Fable 5 até corrigir a camada de histórico | O Fable 5.1 vincula os blocos de raciocínio ao prompt, às ferramentas e ao histórico anteriores. |
| Precisa do menor preço padrão por token | Nenhum dos dois modelos Fable | Ambos custam US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. |
| Executa prompts comuns, sem cache, em uma integração estável com o Fable 5 | Faça uma avaliação primeiro | A economia no preço de tabela pode ser pequena, e os ganhos de benchmark variam conforme a tarefa. |
O que mudou do Fable 5 para o Fable 5.1
O Claude Fable 5.1 mantém o perfil principal de capacidade do Claude Fable 5: janela de contexto de 1 milhão de tokens, saída máxima de 128.000 tokens e raciocínio adaptativo sempre ativado. As diferenças documentadas são o status no ciclo de vida, o corte de conhecimento em junho de 2026 em vez de janeiro de 2026, as leituras de cache mais baratas e novos comportamentos da API relacionados a ferramentas e blocos de raciocínio. (Visão geral legada do Fable 5; Visão geral do modelo Fable 5.1)
| Especificação | Claude Fable 5 | Claude Fable 5.1 |
|---|---|---|
| ID do modelo na API | claude-fable-5 | claude-fable-5-1 |
| Ciclo de vida | Ativo, legado | Ativo, modelo Fable mais recente |
| Data de lançamento | 9 de junho de 2026 | 1º de setembro de 2026 |
| Janela de contexto | 1 milhão de tokens | 1 milhão de tokens |
| Saída máxima | 128 mil tokens | 128 mil tokens |
| Raciocínio | Adaptativo, sempre ativado | Adaptativo, sempre ativado |
| Nível padrão de esforço | Alto | Alto |
| Corte de conhecimento confiável | Janeiro de 2026 | Junho de 2026 |
| Preço de entrada / saída | US$ 10 / US$ 50 por MTok | US$ 10 / US$ 50 por MTok |
| Preço da leitura de cache | US$ 1 / MTok | US$ 0,25 / MTok |
O Fable 5.1 está disponível pela Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. A Anthropic informa que o Fable 5 também está disponível nas mesmas famílias de plataformas, com aposentadoria não prevista antes de 9 de junho de 2027; a aposentadoria do Fable 5.1 não está prevista antes de 1º de setembro de 2027. (Disponibilidade e ciclo de vida do Fable 5.1; Disponibilidade e ciclo de vida do Fable 5)
A diferença de preço está nas leituras de cache, não nas tarifas de tabela
O Fable 5.1 não é mais barato quando recebe tokens novos de entrada ou gera tokens de saída. Ele cobra os mesmos US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída do Fable 5, mas cada leitura de cache custa US$ 0,25 por milhão de tokens, contra US$ 1. (Documentação de preços da Anthropic)
| Categoria de uso | Fable 5 | Fable 5.1 | Mudança |
|---|---|---|---|
| Entrada nova | US$ 10 / MTok | US$ 10 / MTok | Nenhuma |
| Saída | US$ 50 / MTok | US$ 50 / MTok | Nenhuma |
| Gravação de cache de 5 minutos | US$ 12,50 / MTok | US$ 12,50 / MTok | Nenhuma |
| Gravação de cache de 1 hora | US$ 20 / MTok | US$ 20 / MTok | Nenhuma |
| Leitura de cache | US$ 1 / MTok | US$ 0,25 / MTok | 75% menor |
| Entrada / saída em lote | Desconto de 50% | Desconto de 50% | Mesmo desconto informado |
Para uma ilustração simples, imagine que um agente leia dez vezes um contexto de projeto em cache com 1 milhão de tokens e depois gere 200 mil tokens de saída. A parte das leituras de cache custa US$ 10 no Fable 5 e US$ 2,50 no Fable 5.1; a saída custa US$ 10 nos dois modelos. Nessas condições específicas, a conta de tokens cai de US$ 20 para US$ 12,50, uma redução de 37,5%.
A economia real depende de acertos de cache, gravações, tamanho da saída, novas tentativas, chamadas de ferramenta e roteamento de fallback. A Anthropic estima um custo cerca de 25% menor em cargas de trabalho típicas e de até aproximadamente 45% menor em cargas altamente agênticas. (Página do produto Fable da Anthropic)
O uso por assinatura é separado da economia da API. A central de ajuda da Anthropic informa que o Fable 5 e o Fable 5.1 seguem as mesmas regras atuais dos planos: usuários Max e assentos premium dos planos Team ou Enterprise legado podem usar modelos Fable em até 50% do limite semanal, enquanto usuários Pro e assentos padrão usam créditos de uso pré-pago. A promoção anterior do Fable 5 terminou em 19 de julho de 2026, e o Fable 5.1 não fez parte dela. (Orientações da Anthropic sobre os planos)
Os benchmarks mostram um avanço real, mas desigual
A comparação publicada pela Anthropic dá ao Fable 5.1 uma vantagem clara em várias medições de tarefas agênticas e uso de computador, mas o tamanho dessa vantagem vai de modesto a muito grande. São resultados divulgados pelo fornecedor em avaliações protegidas e específicas de cada versão; use-os como referência e valide o desempenho com seus próprios prompts. (Tabela de benchmarks da Anthropic)
| Benchmark | Fable 5.1 | Fable 5 | Diferença |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | +27,9 pontos |
| Terminal-Bench 4.0 | 55,8% | 42,0% | +13,8 pontos |
| GDPval-AA v2 | 1.853 Elo | 1.723 Elo | +130 Elo |
| OSWorld 2.0, parcial | 77,9% | 72,9% | +5,0 pontos |
| OSWorld 2.0, rigoroso | 41,7% | 36,1% | +5,6 pontos |
| Humanity’s Last Exam, sem ferramentas | 60,9% | 57,8% | +3,1 pontos |
| Humanity’s Last Exam, com ferramentas | 65,0% | 63,8% | +1,2 ponto |
| AutomationBench | 31,4% | 17,1% | +14,3 pontos |
| CursorBench 3.2.0 | 73,4% | 70,5% | +2,9 pontos |
A maior diferença publicada aparece no Terminal-Bench-Science 0.1, em que a pontuação divulgada do Fable 5.1 é mais que o dobro da obtida pelo Fable 5. O AutomationBench e o Terminal-Bench 4.0 também registram aumentos expressivos. Já os ganhos menores no Humanity’s Last Exam e no CursorBench sustentam uma conclusão mais específica: o Fable 5.1 não é melhor em todos os tipos de trabalho pela mesma margem.
A tabela da Anthropic mostra o resultado de 55,8% do Terminal-Bench 4.0 para o Fable 5.1 público e apresenta o Mythos 5.1 separadamente, com 60,9%. O Mythos 5.1 não é um substituto disponível de forma geral para o Fable 5.1. (Página do produto da Anthropic)
Migração da API: três comportamentos do Fable 5 para testar primeiro
A Anthropic descreve a migração para o Fable 5.1 como praticamente compatível, mas três mudanças podem causar falhas em produção ou alterar silenciosamente o comportamento do agente. Teste esses pontos antes de trocar o ID do modelo em todos os ambientes. (Guia de migração do Fable 5.1)
1. A escolha forçada de ferramenta retorna um erro 400
O Fable 5.1 aceita tool_choice: {"type":"auto"} e tool_choice: {"type":"none"}. Ele rejeita {"type":"any"} e a seleção forçada de uma ferramenta nomeada com um erro 400 invalid_request_error, inclusive na Messages API, na Message Batches API e no endpoint de contagem de tokens.
Se a aplicação precisa de JSON válido, use saídas estruturadas quando estiverem disponíveis ou mantenha a escolha de ferramenta em auto, combinando um esquema rigoroso com uma instrução explícita. Se a aplicação precisa chamar uma ferramenta específica em um determinado turno, a Anthropic documenta como alternativa uma instrução de sistema anexada e limitada àquele turno.
2. Os blocos de raciocínio ficam vinculados ao modelo que os produziu
O Fable 5.1 consegue ler blocos de raciocínio preservados do Fable 5 e de modelos Claude compatíveis anteriores. Modelos mais antigos não conseguem ler blocos de raciocínio do Fable 5.1; se um fallback enviar a conversa para um modelo antigo, a API descarta os blocos ilegíveis e o fallback precisa planejar tudo novamente.
Os blocos descartados não são cobrados como entrada, mas esse novo ciclo de planejamento pode aumentar a latência e o custo do primeiro turno depois da troca de modelo. Para depuração, a Anthropic documenta o cabeçalho beta thinking-binding-controls-2026-08-01, que informa uma transformação model_binding_mismatch.
3. Editar o histórico anterior pode invalidar a requisição
Em contas mais novas da API, o Fable 5.1 verifica se o prompt de sistema, as ferramentas ou o histórico de mensagens anterior foram alterados antes de um bloco de raciocínio preservado. Editar, reordenar, excluir ou reconstruir esse prefixo pode retornar um erro 400 de assinatura inválida em vez de gerar uma resposta.
O padrão mais seguro é manter um histórico somente de acréscimos. Use compactação no servidor ou edição de contexto em vez de inserir um resumo no meio da transcrição e mantenha estáveis os arquivos usados entre turnos, recorrendo a um file_id da Files API ou a bytes idênticos. Um cliente que já preserva o prefixo exato talvez precise apenas trocar o ID do modelo; já um cliente que reconstrói as mensagens a cada turno precisa primeiro de um adaptador.
Mudanças aditivas que vale a pena usar
O Fable 5.1 também adiciona controles capazes de melhorar um agente de longa duração sem exigir uma reescrita completa:
- Nível de esforço por mensagem: altere entre
low,medium,high,xhighoumaxem um turno posterior sem invalidar o prefixo em cache. - Mensagens de sistema limitadas ao turno: adicione uma instrução para um único turno sem inserir e excluir texto do prompt de sistema anterior.
- Atualizações de progresso: solicite atualizações legíveis entre chamadas de ferramenta usando as configurações de exibição documentadas.
- Preço menor para leituras de cache: mantenha o prefixo repetido, mas meça novamente as taxas de acerto de cache depois da migração.
O nome do nível de esforço não representa uma unidade de trabalho portátil. Comece com o padrão documentado, high, e depois compare qualidade, latência e total de tokens nos níveis medium e superiores usando o conjunto real de tarefas.
Acesso, cotas e fallback podem mudar o resultado na prática
O Fable 5.1 está amplamente disponível nos planos Claude pagos e pela API da Anthropic e pelas plataformas de nuvem listadas, mas ter acesso pelo plano não significa uso ilimitado incluído. Usuários Pro e assentos padrão do Team podem precisar de créditos de uso desde a primeira requisição, enquanto usuários Max e assentos premium compartilham uma parcela semanal específica do Fable. O Claude Code exige a versão 2.1.250 ou posterior para usar o Fable 5.1; o Fable 5 exige a versão 2.1.170 ou posterior. (Guia de planos e acesso da Anthropic)
A troca automática também pode fazer uma comparação entre Fable 5 e Fable 5.1 parecer diferente no aplicativo e na API. A Anthropic afirma que solicitações sensíveis de cibersegurança e biologia podem ser encaminhadas para modelos Opus de fallback e que a troca automática vem ativada por padrão nas interfaces do Claude. Na API, os desenvolvedores precisam configurar os fallbacks; uma recusa é retornada como uma resposta HTTP bem-sucedida, com um motivo de parada de recusa, a menos que o tratamento de fallback seja adicionado. (Orientações da Anthropic sobre fallback)
Relatos iniciais de usuários são anedóticos, mas apontam para dois custos que um piloto deve medir:
“O 5.1 parece bom, mas parece mesmo mais lento.” — u/BeowulfShaeffer, discussão sobre o lançamento no r/ClaudeAI
“Já estou em 100% do uso.” — u/noeyb, discussão sobre o lançamento no r/ClaudeAI
Esses comentários não estabelecem uma taxa geral de desempenho, mas tornam importante registrar o tempo total de execução e o consumo da cota junto com a qualidade das respostas.
Uma tabela de decisão para usuários do Fable 5
| Situação | Escolha prática |
|---|---|
| Agente novo com leituras repetidas de contexto | Fable 5.1, com registro de acertos de cache e latência desde o primeiro dia |
| Agente existente no Fable 5 com histórico somente de acréscimos e ferramentas automáticas | Faça um piloto do Fable 5.1 em um recorte representativo de tarefas |
| Agente existente que força ferramentas nomeadas | Corrija primeiro a seleção de ferramentas e só então teste o Fable 5.1 |
| Cliente existente que reescreve mensagens ou prompts de sistema antigos | Mantenha o Fable 5 como fallback enquanto a camada de histórico é redesenhada |
| Predominância de prompts novos, com pouco reaproveitamento de cache | Compare o custo por tarefa concluída, não apenas as tarifas por token |
| Trabalho com probabilidade de acionar proteções de cibersegurança ou biologia | Modele o caminho de fallback e seus preços de Opus antes de migrar |
| Necessidade de tarifas menores para entrada e saída padrão | Compare outro modelo da Anthropic, porque o Fable 5.1 e o Fable 5 têm tarifas de tabela idênticas |
Um teste prático de migração pode ser pequeno: reproduza de 20 a 50 tarefas representativas, fixe as mesmas ferramentas e prompts e registre taxa de sucesso, erros de ferramenta forçada, quantidade de fallbacks, tokens de leitura de cache, total de tokens de entrada e saída, latência, consumo da cota e custo por tarefa concluída. Promova o Fable 5.1 apenas se ele atingir o nível de qualidade exigido sem criar uma falha inaceitável de compatibilidade ou de cota.
As perguntas que os compradores ainda fazem
Por que o Claude trocou o Fable 5.1?
Um classificador de segurança pode acionar um fallback automático para algumas solicitações de cibersegurança, biologia, extração de raciocínio ou desenvolvimento de modelos de fronteira. Nos aplicativos do Claude, a solicitação pode ser executada novamente em um modelo Opus; na API, o comportamento de fallback precisa ser configurado pelo desenvolvedor. (Orientações da Anthropic sobre fallback)
O Fable 5.1 é o melhor alvo para um novo agente de horizonte longo e para cargas do Fable 5 com reaproveitamento substancial de cache. Mantenha o Fable 5 durante um piloto de compatibilidade quando a integração força ferramentas, edita o histórico de mensagens ou não tolera incertezas de fallback e de cota.