Lançamento Oficial do DeepSeek V4: O que Está Mudando e Quando

Última Atualização: 2026-07-20 06:08:04

A próxima coisa a observar da DeepSeek não é a R2 nem a V5. É o lançamento oficial da V4 em si. Diversos veículos informam que a DeepSeek está mirando um lançamento em meados de julho de 2026 para a versão oficial e, ao contrário de um carimbo cosmético de "GA", isso traz duas mudanças com as quais você pode planejar seu orçamento: precificação da API em horário de pico e desempenho mais forte em agentes, matemática e código. O que você pode chamar hoje, deepseek-v4-pro e deepseek-v4-flash, ainda é a prévia de 24 de abril, e em 20 de julho de 2026 a versão oficial ainda não apareceu no registro de alterações da DeepSeek. Este artigo analisa o que a versão oficial muda, quando ela chega e se vale a pena construir agora ou esperar.

O que o DeepSeek V4 oficial mudará

Duas coisas separam o próximo lançamento oficial da prévia que está no ar desde abril. Ambas são concretas, não marketing.

Preços de pico são a manchete. Em uma mudança ainda rara para uma API de LLM de fronteira, a DeepSeek deve cobrar pelo V4 de acordo com a hora do dia. Segundo a InfoWorld e a Let's Data Science, as chamadas durante o horário comercial de pico em Pequim (09:00–12:00 e 14:00–18:00) custarão o dobro da tarifa fora de pico, enquanto os preços fora de pico permanecem como estão hoje. Os valores reportados colocam a saída do V4-Pro em ¥6 por milhão de tokens fora de pico versus ¥12 no pico, e o V4-Flash em ¥2 versus ¥4. A DeepSeek apresenta isso como uma forma de distribuir a carga para manter a estabilidade, e não como um aumento linear, mas o efeito prático é o mesmo: o tráfego interativo durante o dia fica mais caro, e trabalhos em lote ou tolerantes a latência que rodam fora de pico continuam baratos. A precificação por horário é normal nos mercados de eletricidade e de cloud spot; vê-la em uma API de LLM indica que a demanda por inferência, e não o treinamento, é agora a restrição limitante da DeepSeek.

O desempenho aumenta. O mesmo relatório afirma que a versão oficial estende a prévia com maior capacidade agentic, matemática e de geração de código, e torna a janela de contexto de 1M de tokens padrão em toda a linha. Considere a magnitude exata como não verificada até que benchmarks independentes sejam divulgados, mas a direção indica um aumento de capacidade sobre os mesmos dois IDs de modelo, não uma nova família.

O que não está mudando: os modelos continuam open-weight, e você ainda chama deepseek-v4-pro ou deepseek-v4-flash. Portanto, o lançamento oficial é um evento de preço e qualidade, não um evento de migração.

Quando a versão oficial será lançada?

A resposta curta: há relatos de um período em meados de julho de 2026, mas o lançamento ainda não foi confirmado. Em 20 de julho de 2026, esse período já está no limite ou passou, e no registro oficial de alterações a entrada datada mais recente ainda é 24 de abril de 2026, a versão de prévia. Então, a conversa de que “o V4 será lançado em julho” está meio certa: há relatos de uma versão oficial, mas ela ainda não está disponível na documentação.

DeepSeek API Change Log showing the April 24, 2026 V4 entry as the latest update, with the July 24 legacy-model deprecation notice

Dois sinais confiáveis indicarão que a versão oficial está realmente no ar, em vez de ser apenas outro boato: uma nova entrada datada no registro de alterações e números atualizados na página de preços oficial. Quando isso mudar, foi lançado. Até lá, você está na prévia.

Quanto custa o V4 hoje e após o lançamento oficial

O preço é onde o lançamento oficial pega forte, então vale a pena entender primeiro a referência atual. كثيرos textos ainda citam o DeepSeek-V4-Pro por US$ 3,48 por milhão de tokens de saída. Esse era o preço de lançamento e já ficou no passado.

Aqui está a precificação atual na página oficial de preços da DeepSeek, verificada em 20 de julho de 2026 (todos os valores por 1M tokens, USD):

ModeloEntrada (cache hit)Entrada (cache miss)Saída
deepseek-v4-flash$0.0028$0.14$0.28
deepseek-v4-pro$0.003625$0.435$0.87

O motivo pelo qual o Pro está em $0.87 e não em $3.48: um desconto de lançamento de 75% reduziu-o a um quarto do seu valor original, e, quando a promoção terminou em 31 de maio de 2026, a DeepSeek manteve essa taxa mais baixa como o novo padrão, em vez de permitir que ela voltasse ao valor anterior.

Bar chart comparing DeepSeek V4 output token price at launch versus current, showing V4-Pro dropping from $3.48 to $0.87 while V4-Flash holds at $0.28

Agora, coloque o lançamento oficial sobre isso. Quando a precificação de horário de pico entrar em vigor, os US$ 0,87 de hoje se tornam o piso fora do horário de pico para o Pro, e as chamadas em horário comercial praticamente dobram. Para um chatbot atendendo usuários das 9 às 17, isso é um aumento real; para um pipeline em lote noturno, quase nada muda. Duas alavancas mantêm o gasto estável: agendar trabalhos tolerantes para fora do pico e aproveitar a precificação de entrada com acerto de cache, que é cerca de 50x mais barata do que uma falha de cache no Pro. Se você estiver modelando uma carga de trabalho real, a dinâmica de custos corporativos de executar o DeepSeek depende mais do comportamento do cache, das janelas de pico e dos limites de throughput do que do preço de tabela.

O prazo de 24 de julho que já está definido

Uma mudança datada não é um rumor: em 24 de julho de 2026, 15:59 UTC, os nomes dos modelos legados deepseek-chat e deepseek-reasoner serão descontinuados. Se o seu código ainda os chamar, ele quebrará depois disso.

A migração é pequena, e fazer isso agora também coloca você nos IDs de modelo que a versão oficial usará:

  • Altere o parâmetro model para deepseek-v4-flash ou deepseek-v4-pro.
  • Mantenha o mesmo base_url (https://api.deepseek.com); ele não muda.
  • Ambos os modelos funcionam pela interface OpenAI ChatCompletions e pela interface Anthropic, então sua biblioteca cliente permanece a mesma.

Durante a transição, os nomes antigos mapeiam para os modos sem raciocínio e com raciocínio de deepseek-v4-flash, então você já está efetivamente no V4 — os aliases simplesmente deixam de existir. Se você encaminhar o DeepSeek por meio de um agregador, a mudança no nome do modelo é a mesma; plataformas como AIReiter expõem os IDs do V4 pelo mesmo endpoint compatível com Anthropic.

Construir na prévia agora, ou esperar pela versão oficial?

Para a maioria das equipes, a resposta é construir agora — com o lançamento oficial já considerado no preço.

A versão de prévia é estável o suficiente para produção e, a US$ 0,87 por milhão de tokens de saída fora do horário de pico, barata. O V4-Pro em sua configuração máxima de raciocínio (um modo que a DeepSeek chama de Pro-Max) foi relatado em torno de 80,6% no SWE-bench Verified, próximo dos modelos fechados mais fortes; esses números são autorrelatados ou de terceiros, não nossos próprios testes, então considere-os adequadamente. Em termos de custo, um fio do Reddit resumiu o apelo como "17x mais barato" do que o que as pessoas estavam pagando em outros lugares.

Aguardar a versão oficial traz um ganho de desempenho, mas também a sobretaxa de horário de pico, e atrasa o trabalho para um lançamento que, até 20 de julho, ainda não havia sido publicado no changelog. O caminho pragmático: lançar na preview, considerar no orçamento a precificação de pico para o tráfego interativo e testar novamente quando os números oficiais forem divulgados.

Qual modelo? Desenvolvedores no Reddit descrevem o Flash como um "worker super barato" para tarefas bem delimitadas e recorrem ao Pro para raciocínio de ponta; as diferenças entre Flash e Pro se resumem a essa divisão. Duas ressalvas valem em qualquer caso: o throughput do V4-Pro é limitado por capacidade (a DeepSeek já disse isso), então o Pro pode ser mais lento sob carga, e o V4 é apenas texto — imagem, áudio e vídeo ficam em linhas separadas da DeepSeek (Janus, DeepSeek-VL2, DeepSeek-OCR), e não se espera que o lançamento oficial mude isso.

E quanto ao R2 e V5?

Nenhum deles é a história de curto prazo, apesar do volume de buscas. R2 ainda não foi lançado e não há data confirmada; a DeepSeek negou janelas específicas, e as "especificações" vazadas se contradizem (um modelo MoE de ~1,2T em um vazamento, um modelo denso de 32B em outro). V5 é ainda mais incerto: a afirmação viral de "V5 em 24 de julho" é uma interpretação equivocada da data de aposentadoria do alias legado. O próximo marco confiável é aquele sobre o qual este artigo trata — o V4 oficial — e não uma nova geração.

Perguntas Frequentes

Quando será lançado o DeepSeek V4 oficial?

Vários veículos relataram uma janela em meados de julho de 2026, mas ela ainda não havia aparecido no registro de alterações da API até 20 de julho de 2026. Acompanhe o registro de alterações e a página de preços para confirmar se ela realmente foi lançada.

O que há de novo na versão oficial V4 em comparação com a prévia?

Duas coisas: preços de API em horário de pico (chamadas em horário comercial custam aproximadamente o dobro da tarifa fora de pico) e desempenho mais forte em agentic, matemática e código, com contexto de 1M como padrão em toda a linha. Os IDs dos modelos e a licença de open-weight permanecem os mesmos.

Quanto custará o DeepSeek V4 oficial?

Espera-se que o preço fora de pico corresponda à tarifa de hoje: $0.87 por 1M output tokens para V4-Pro, $0.28 para V4-Flash. As chamadas no horário de pico devem custar cerca de duas vezes isso. O input com cache hit é muito mais barato em ambos.

O DeepSeek V4 já pode ser usado agora?

Sim. O V4-Pro e o V4-Flash têm estado públicos, com pesos abertos (licenciados sob MIT, na organização Hugging Face da DeepSeek), e podem ser chamados desde 24 de abril de 2026. Você não precisa esperar pelo lançamento oficial para usá-los como base.

Preciso migrar antes de 24 de julho de 2026?

Somente se o seu código ainda chamar deepseek-chat ou deepseek-reasoner. Altere o nome do modelo para deepseek-v4-flash ou deepseek-v4-pro antes de 24 de julho de 2026, 15:59 UTC; nada mais na sua solicitação muda.