Claude Opus 5 vs Sonnet 5: quem vence com o mesmo orçamento

Última Atualização: 2026-07-25 05:09:39

O Sonnet 5 chegou em 30 de junho de 2026 e, quase de imediato, uma reclamação no r/ClaudeAI expôs algo que a tabela de preços não deixa claro: "Sonnet 5 é pior que Opus pelo mesmo preço em high e xhigh?"

Um usuário resumiu a explicação em uma frase. O Sonnet é "de fato mais barato por token, mas leva muito mais etapas e tokens para concluir as tarefas; é isso que faz ele perder a vantagem de preço."

Ele estava certo, com uma exceção. Em um comparativo entre Claude Opus 5 e Sonnet 5 com o mesmo orçamento, o Opus vence quase sempre: acima de cerca de US$ 2,30 por tarefa, usar o Opus em um nível de esforço abaixo supera o Sonnet em um nível acima, tanto em custo quanto em qualidade. Abaixo dessa faixa — e em tarefas curtas, resolvidas de uma só vez — o Sonnet 5 é 3,4x mais barato.

Onde cada modelo leva vantagem

Claude Opus 5Claude Sonnet 5
ID do modeloclaude-opus-5claude-sonnet-5
Lançamento24 de julho de 202630 de junho de 2026
Entrada / saída por MTokUS$ 5 / US$ 25US$ 2 / US$ 10 até 31 de agosto de 2026; depois, US$ 3 / US$ 15
Entrada / saída em batchUS$ 2,50 / US$ 12,50US$ 1 / US$ 5 até 31 de agosto de 2026
Níveis de esforçolow, medium, high, xhigh, max (high é o padrão)os mesmos cinco níveis (high é o padrão)
Raciocínio estendidoativado por padrãoadaptativo
Contexto / saída máxima1M / 128k tokens1M / 128k tokens
Corte de conhecimentomaio de 2026janeiro de 2026
Desconto por tokennenhum60% abaixo do Opus hoje; 40% abaixo a partir de 1º de setembro
Melhor usoexecuções agentivas de longo horizonte, raciocínio difícil e trabalho caro de revisarextração em uma única chamada, alta concorrência e UX sensível à latência
Nosso teste rápido com quatro tarefas4/4 aprovadas, 1.182 tokens de saída, 2,955¢4/4 aprovadas, 858 tokens de saída, 0,858¢

Ainda não há benchmark público de longo horizonte com o Opus 5. Por isso, o Opus 4.8 ocupa a coluna do Opus nas tabelas de custo por tarefa abaixo. Considere essas linhas um piso conservador: os dois têm o mesmo preço, e a Anthropic posiciona o Opus 5 à frente do 4.8 em trabalho agentivo.

Faz sentido comparar Claude Opus 5 e Sonnet 5 com orçamentos equivalentes porque os dois aceitam o mesmo parâmetro effort, nos mesmos cinco níveis e sem beta header. Em vez de trocar de modelo, você compra mais capacidade ao girar esse controle. Os preços vêm da página de preços da Claude Platform, consultada em 25 de julho de 2026.

Página da documentação da Claude Platform da Anthropic sobre o parâmetro effort, listando Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8, Claude Sonnet 5 e outros como modelos compatíveis, e observando que Claude usa esforço high por padrão

O ponto em que as curvas de custo se cruzam

Os números por nível vêm do DeepSWE v1.1, ranking de agentes de longo horizonte da Datacurve:

  • 113 tarefas escritas do zero, e não extraídas de PRs já mesclados, base da alegação de ausência de contaminação
  • 91 repositórios em 5 linguagens
  • Um único harness para todos os modelos, com quatro execuções por tarefa
  • Última atualização em 21 de julho, três dias antes do lançamento do Opus 5

Assim, o Opus 4.8 está na coluna do Opus, e a variável em aberto é se o Opus 5 consome mais tokens por tarefa do que o 4.8 consumia.

EsforçoSonnet 5 US$/tarefaOpus 4.8 US$/tarefaSonnet ÷ OpusSonnet pass@1Opus pass@1
lowUS$ 2,19US$ 2,290,95x30,5%40,8%
mediumUS$ 4,08US$ 3,441,18x39,8%48,7%
highUS$ 7,43US$ 4,281,73x48,2%51,8%
xhighUS$ 11,89US$ 8,011,49x49,7%54,4%
maxUS$ 26,40US$ 13,222,00x53,8%59,0%

O Sonnet 5 só é mais barato em um único nível, o low — justamente onde abre mão de 10,3 pontos percentuais de taxa de aprovação.

Por que o modelo mais barato gera uma conta maior

O fator decisivo não é a verbosidade, e sim a quantidade de etapas.

EsforçoMediana de etapas do Sonnet 5Mediana de etapas do Opus 4.8Entrada por tarefa do SonnetEntrada por tarefa do Opus
low70474,5M2,4M
max26011672,4M17,0M

Um desconto de 60% por token não se sustenta quando o modelo precisa ler quatro vezes mais texto.

Por que a coluna de custos é confiável

Primeiro, uma ressalva: o DeepSWE não divulga a base de preços usada.

Uma execução separada, com 24 tarefas em 13 de julho, avaliou os dois modelos em todos os cinco níveis no Claude Code. Ao multiplicar a coluna do Sonnet no DeepSWE por 0,67 — preço promocional de US$ 2/US$ 10 contra o padrão de US$ 3/US$ 15 — os dois conjuntos batem com diferença de até 0,03 em todos os níveis.

São dois conjuntos independentes de tarefas e um único cruzamento, no mesmo ponto entre medium e high. Essa concordância também é uma boa indicação de que o DeepSWE cobrou o Sonnet pelas tarifas padrão.

O autor constrói e vende o Stet, o harness ligado naquele post. Portanto, trate o resultado como um teste do próprio fornecedor.

Mesmo orçamento, níveis diferentes: a comparação que importa

Tabelas que comparam o mesmo tier respondem à pergunta errada, porque ninguém compra um nível de esforço. Você compra um resultado dentro de um preço. Quando Claude Opus 5 e Sonnet 5 são comparados assim, a ordem muda.

A tabela abaixo mostra, para cada configuração do Sonnet 5, o tier mais barato do Opus 4.8 capaz de igualar ou superar sua taxa de aprovação. A coluna promocional é o valor da tarifa padrão multiplicado por 0,67.

Configuração do Sonnet 5Sonnet pass@1Sonnet US$, padrãoSonnet US$, promocional (est.)Tier mais barato do Opus 4.8 que o igualaOpus US$Opus pass@1Custo do Opus vs. Sonnet promocionalDiferença de qualidade
low30,5%US$ 2,19US$ 1,47lowUS$ 2,2940,8%1,56x+10,3pp
medium39,8%US$ 4,08US$ 2,73lowUS$ 2,2940,8%0,84x+1,0pp
high48,2%US$ 7,43US$ 4,98mediumUS$ 3,4448,7%0,69x+0,4pp
xhigh49,7%US$ 11,89US$ 7,97highUS$ 4,2851,8%0,54x+2,1pp
max53,8%US$ 26,40US$ 17,69xhighUS$ 8,0154,4%0,45x+0,5pp

Leia as duas últimas colunas de cima a baixo. Ao usar o Opus em um nível abaixo do Sonnet que você consideraria, você obtém a mesma taxa de aprovação ou uma taxa maior, gastando de 16% a 55% menos — mesmo diante do preço promocional. Só a primeira linha inverte esse padrão: em low, o Sonnet 5 promocional custa 36% menos, mas entrega 10,3 pontos percentuais de aprovação.

O argumento na direção oposta

Um comentário naquela primeira discussão usou o gráfico oficial em esforço medium: Opus perto de US$ 7 contra US$ 4,50 do Sonnet, para taxas de sucesso de 68% e 62%, respectivamente — "um aumento de 55% no preço por menos de 10% de melhoria na taxa de sucesso neste teste".

Essa troca faz sentido quando errar por 6 pontos não tem custo. Deixa de fazer quando um diff ruim pode chegar à produção.

As duas leituras dependem da distribuição de tarefas de outra pessoa. Rodar de 20 a 50 tarefas próprias e medir custo por conclusão bem-sucedida, em vez de custo por token, vale mais do que qualquer tabela desta página.

O que o Opus 5 muda mantendo US$ 5 e US$ 25

O preço de lançamento do Opus 5 é idêntico ao do Opus 4.8. A questão em aberto, então, é a terceira dimensão: tokens por tarefa. As evidências apontam em ambas as direções.

Indícios de que o Opus 5 custa menos por tarefaIndícios de que ele custa mais
A Anthropic informa que o Opus 5 lidera o Frontier-Bench v0.1 e "mais que dobra o desempenho do Opus 4.8 com menor custo por tarefa" (dado do fornecedor, em execuções próprias, sem reprodução independente)O raciocínio estendido vem ativado por padrão, enquanto no Opus 4.8 ficava desativado
Um parceiro jurídico não identificado observou cerca de 26% menos tokens em raciocínio máximo (relato da Anthropic, sem metodologia divulgada)Em nossas quatro tarefas, o Opus 4.8 usou 380 tokens de saída; o Opus 5, 1.182

Os dois cenários continuam possíveis. Antes de comprometer um orçamento, meça de novo as colunas de custo no seu próprio repositório.

Há uma armadilha para quem tentar cortar o custo do Opus 5 pelo caminho óbvio: thinking: {"type": "disabled"} só é aceito até o esforço high e retorna 400 em xhigh ou max. Essa é uma das várias mudanças incompatíveis entre Opus 4.8 e Opus 5 que vale revisar antes de uma migração.

Onde o Sonnet 5 vence: tarefas curtas e de uma só chamada

Rodamos os dois modelos em quatro tarefas pequenas em 24 de julho de 2026, todas avaliadas por script, não por opinião: corrigir dois defeitos em kth_smallest; emitir JSON estrito, com ordem fixa de chaves e checksum consistente; responder 65 em uma questão sobre número de Frobenius; e fazer um refactor que adiciona validação, preserva a assinatura e não deixa comentários.

Os dois passaram nas quatro. A diferença apareceu no custo.

Claude Sonnet 5Claude Opus 5
Verificações aprovadas4/44/4
Tokens de saída, quatro tarefas8581.182
Latência total13,7s24,6s
Custo de saída nas tarifas promocional / padrão0,858¢ / 1,287¢2,955¢
Gráfico de barras horizontais do custo de tokens de saída, em centavos de dólar, para as mesmas quatro tarefas: Sonnet 5 a US$ 10 por MTok na tarifa promocional custa 0,858 centavo, Sonnet 5 a US$ 15 por MTok na tarifa padrão custa 1,287 centavo, e Opus 5 a US$ 25 por MTok custa 2,955 centavos

Com saídas verificadas idênticas, o Opus 5 custou 3,4x mais com o preço atual do Sonnet — ou 2,3x mais depois do fim da promoção — e levou pouco mais da metade do tempo total. Repetir as duas tarefas de código pelo canal oficial do Claude Code indicou a mesma tendência: 240 tokens de saída para o Sonnet 5, contra 465 para o Opus 5.

Três limitações importam mais do que esse número:

  • Uma execução por modelo em cada tarefa. É um teste rápido, não um benchmark.
  • Somente custos de tokens de saída, nas tarifas oficiais de saída, porque o gateway injetou um system prompt variável que tornou os contadores de tokens de entrada inutilizáveis para calcular cobrança.
  • Quatro prompts curtos, justamente o cenário excluído pela discussão da comunidade. Nada aqui roda 70 etapas, portanto nada reproduz a explosão de etapas.

Dentro desses limites, o desconto do Sonnet 5 permanece intacto. Um desenvolvedor descreveu exatamente esse tipo de trabalho: agentes voltados a documentos, fazendo "extrações de uma só vez com raciocínio mínimo", cenário em que "Opus seria exagero".

Todo número aqui depende de duas datas

30 de junho de 2026: o gráfico oficial de custo foi revisado

O anúncio do Claude Sonnet 5 da Anthropic traz uma nota no changelog. O gráfico original de custo e desempenho usava "uma metodologia mais simples que não refletia a metodologia padrão usada em avaliações de busca agentiva", o que teve "o efeito de subestimar o desempenho do Sonnet 5 na avaliação".

O gráfico e o texto ao redor foram revisados para seguir a metodologia BrowseComp do system card, que "usou um orçamento de 10M tokens com compactação e chamadas programáticas de ferramentas".

Portanto, se você citar esse gráfico, confira qual revisão está vendo e leia a legenda: ela precifica o Sonnet 5 na tarifa padrão de US$ 3/US$ 15, observa que o preço promocional deixa o custo real abaixo do gráfico e usa US$ 5/US$ 25 para o Opus 4.8.

1º de setembro de 2026: termina o preço promocional

A tarifa introdutória do Sonnet 5 expira, todas as linhas publicadas sobem 50%, e o Opus 5 permanece em US$ 5/US$ 25. Restam 37 dias de margem desde a publicação; depois disso, qualquer modelo de gastos baseado nas tarifas atuais estará errado.

Há outra data citada nessas discussões que não se aplica aqui. O tokenizer do Claude 4.7 gera cerca de 30% mais tokens para o mesmo texto do que o do Sonnet 4.6, então comparar o preço por token do Sonnet 5 com o Sonnet 4.6 subestima o aumento real. Opus 5 e Sonnet 5 usam esse mesmo tokenizer, portanto esse efeito se anula entre os dois.

Qual escolher em cada faixa de orçamento

Claude Opus 5 vs Sonnet 5 se resume melhor a três regras de roteamento do que a um vencedor absoluto. Os limites usam o custo médio por tarefa do DeepSWE, com o Opus 4.8 no lugar do Opus, e servem como faixas iniciais para trabalho em repositórios — não como constantes para agentes de pesquisa, pipelines de suporte ou fluxos de documentos.

  • Abaixo de cerca de US$ 2,30 por tarefa, escolha o Sonnet 5 em low. É a única configuração agentiva em que sua vantagem de preço se mantém, ao custo de uma taxa de aprovação de 30,5%. Para extração em uma chamada, classificação ou qualquer trabalho com saída limitada, fique aqui e aproveite os 3,4x que medimos. Um desenvolvedor chamou o Sonnet 5 de "próximo o bastante do Opus para 90% do trabalho, mas instantâneo (comparativamente)", algo relevante quando há uma pessoa esperando.
  • De cerca de US$ 2,30 a US$ 8 por tarefa, use o Opus um nível abaixo em vez de subir o Sonnet um nível. Opus medium como padrão de trabalho; Opus high quando um erro é caro de encontrar na revisão. No Opus 5, o preço por token é idêntico, mas os tokens por tarefa ainda não foram medidos. Trate essa faixa como o ponto de partida para seus testes.
  • Acima de US$ 8, pare de aumentar o nível do Sonnet. O Sonnet 5 em max custou US$ 26,40 por tarefa para 53,8% no DeepSWE; o Opus 4.8 em xhigh custou US$ 8,01 para 54,4%; o Fable 5 em low chegou a 59,6% por US$ 3,76. A AIReiter lista o Opus 4.8 por US$ 1,56/US$ 7,76 por MTok, cerca de 69% abaixo da tabela, embora sua linha Claude ainda não inclua o Opus 5.

Perguntas frequentes

Claude Opus 5 é mais caro que Sonnet 5?

Por token, sim: US$ 5/US$ 25 contra os US$ 2/US$ 10 promocionais do Sonnet 5. Isso equivale a 2,5x o preço até 31 de agosto de 2026 e 1,67x depois. Por tarefa concluída, a ordem pode se inverter — e as medianas confirmam isso, não apenas algumas execuções fora da curva. No DeepSWE, o custo mediano em esforço max foi de US$ 23,28 para o Sonnet 5, contra US$ 12,35 para o Opus 4.8.

Quanto custa o Claude Sonnet 5?

US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída até 31 de agosto de 2026; depois, US$ 3 e US$ 15 a partir de 1º de setembro. O aumento é de 50% em todas as linhas publicadas: gravações de cache de 5 minutos sobem de US$ 2,50 para US$ 3,75; gravações de cache de 1 hora, de US$ 4 para US$ 6; e acertos de cache, de US$ 0,20 para US$ 0,30. O preço em batch é US$ 1/US$ 5 durante a promoção.

Por que um modelo mais barato acaba custando mais?

Porque a cobrança acompanha as etapas, não as tarefas. Ao longo do controle de esforço, a mediana de etapas do Sonnet 5 sobe de 70 para 260, contra 47 a 116 do Opus 4.8, e sua leitura de entrada chega a 72,4M tokens por tarefa, contra 17,0M em max. Ler quatro vezes mais anula um desconto de 60% em cada token.

O Opus 5 é muito melhor que o Sonnet 5?

Em tentativas únicas, sim: o Opus 4.8 superou o Sonnet 5 por 3,5 a 10,3 pontos percentuais de pass@1 no DeepSWE, com a maior distância no nível mais baixo.

Dê quatro tentativas a ambos e a diferença quase desaparece: o Sonnet 5 em high alcançou 79,6% de pass@4, contra 77,9% do Opus 4.8; em max, os dois ficaram em 78,8% e 79,3%. O Sonnet pode chegar lá, mas precisa de mais tentativas — e você paga por todas elas.

O aumento de preço do Sonnet 5 em 1º de setembro muda a resposta?

Ele reduz o ponto de cruzamento, em vez de elevá-lo. A vantagem por token do Sonnet 5 cai de 60% para 40%, enquanto o Opus 5 permanece em US$ 5/US$ 25. Assim, todas as combinações da tabela de orçamento equivalente pioram para o Sonnet. A única linha favorável ao Sonnet — seu tier low, 36% abaixo do Opus low no preço introdutório — cai para cerca de 4% abaixo na tarifa padrão.

Leitura relacionada