Qwen3.8 Open Weights: Data de Lançamento, Vazamentos e O que Esperar

Última Atualização: 2026-07-20 03:25:12

A conta oficial da Alibaba para o Qwen no X anunciou o Qwen3.8-Max-Preview em 19 de julho de 2026 e disse que os open weights estão "coming soon", sem uma data. Então, o modelo que você pode testar hoje é uma prévia hospedada, não um download. O lançamento em open-weight é o que as pessoas realmente estão esperando, e, no momento, o cronograma é contraditório e o número de destaque de 2,4 trilhões de parâmetros esconde o número que importa. Os detalhes confirmados são escassos, o cronograma vazado aponta em três direções diferentes, e o único número que decide o custo no mundo real ainda não foi publicado.

O que o Qwen3.8-Max-Preview realmente é

Qwen3.8-Max-Preview é a versão hospedada e de acesso antecipado do próximo carro-chefe da Alibaba. A conta Qwen da Alibaba o descreve como um modelo multimodal completo de 2,4 trilhões de parâmetros (texto, imagem e muito mais em um único modelo), que ela posiciona como "segundo apenas a" Claude Fable 5 da Anthropic.

Você pode testá-lo agora, mas apenas em locais específicos: a assinatura Token Plan da Alibaba Cloud e as plataformas agentic Qoder e QoderWork. Ele não é o padrão no aplicativo web gratuito Qwen Chat, que ainda carrega o Qwen3.7-Plus, a geração anterior.

Qwen Chat web app showing Qwen3.7-Plus as the default model, not Qwen3.8

"Preview" é um aviso literal aqui. A Alibaba diz que as capacidades do modelo continuarão mudando durante o período de preview, então qualquer pontuação ou comportamento que você veja hoje pode mudar antes do envio dos weights.

O teste furtivo "Kaleb" que revelou isso

A prévia não surgiu do nada. Antes da revelação oficial, testadores no X apontaram que o Qwen3.8-Max vinha sendo executado na arena pública de comparação de modelos LMArena sob o codinome furtivo "Kaleb." Os laboratórios usam codinomes anônimos para coletar votos cegos em confrontos diretos antes de associar sua marca a um modelo.

Esse detalhe importa por um motivo: o burburinho inicial de que o modelo era forte na geração de código frontend remonta a esses confrontos cegos com Kaleb, e não ao marketing da Alibaba. É o sinal mais próximo de uma fonte independente que existe até agora, embora ninguém tenha publicado um resultado arquivado do Kaleb para confirmar a identidade, então trate isso como uma forte alegação da comunidade, e não como prova.

Quando serão lançados os open weights do Qwen3.8?

Três cronogramas diferentes estão circulando, e eles não concordam:

FonteCronograma alegado
Alibaba Qwen, postagem oficial no X"Open-weight em breve", sem data
Publicações de vazamento no dia do lançamento no XLançamento global até o fim de julho de 2026
Reddit r/Qwen_AI (de segunda mão, funcionário da Alibaba em uma conferência em Paris)Agosto de 2026

"Em breve", "fim de julho" e "agosto" não são a mesma promessa. A afirmação de fim de julho vem de posts de vazamento no dia do lançamento no X. A informação de agosto é um relato de segunda mão de um comentário de um funcionário da Alibaba, publicado no Reddit, e deve ser tratada como a mais incerta das três.

Há também um problema de histórico. Os dois modelos Max carro-chefe mais recentes da Alibaba não foram lançados com pesos abertos no dia um, e a geração anterior permaneceu fechada por um período após o lançamento. Uma promessa de pesos abertos vinculada a uma prévia é uma promessa, não um lançamento.

Em contraste, a Moonshot vinculou uma data de calendário específica aos pesos concorrentes do Kimi K3, em vez de um vago "em breve". A data exata e os cálculos de hardware estão em nossa análise de pesos abertos do Kimi K3. O Qwen3.8 ainda não tem uma data definitiva equivalente.

O número 2,4T não é o que importa

"2.4 trilhões de parâmetros" é o número principal, mas, para um modelo de mistura de especialistas (MoE), é o menos útil. Modelos MoE encaminham cada token por apenas uma fração de seus parâmetros totais, os "parâmetros ativos" por token, então a contagem total diz quase nada sobre velocidade ou custo de serving.

A Alibaba não publicou a contagem de parâmetros ativos. Até que isso aconteça, você não consegue estimar o quão caro será executar o modelo, quão rápido ele será ou de que hardware uma cópia auto-hospedada precisa. Um total de 2,4T poderia ativar de dezenas a algumas centenas de bilhões de parâmetros por token, e cada um desses cenários tem implicações de custo muito diferentes.

Esta é a lacuna mais importante para qualquer pessoa que planeje fazer self-host. Um testador no X brincou sobre precisar de várias placas RTX 6000 Pro para executar uma versão quantizada em 4 bits, e isso continua sendo um palpite até que o número de parâmetros ativos e os arquivos de pesos reais existam.

O que os primeiros testadores estão realmente vendo

Como a prévia está ao vivo, as reações de primeira mão já estão chegando, e elas se dividem fortemente entre benchmarks e uso real.

No lado dos benchmarks, os números do KingBench 3 relatados pela comunidade colocam o Qwen3.8-Max acima do Opus 4.8 e do Kimi K3, com apenas o Fable 5 à frente. Um desenvolvedor que publica como @Leo_R_UK no X disse que uma suíte de agente de código com seis tarefas executada pela API direta obteve 59/60, o melhor resultado que ele havia registrado.

Community-reported KingBench 3 scores placing Qwen3.8-Max-Preview second behind Claude Fable 5

Trate esse gráfico como uma alegação de fornecedor e da comunidade, não verificada. A Alibaba não publicou tabelas oficiais de benchmark, então cada número aqui é, ou uma reivindicação própria, ou uma avaliação executada por usuários em uma pequena amostra.

Os relatos do mundo real são mais interessantes. Testadores como @synthwavedd e @VoltraceGG no X disseram que o modelo parece ficar um degrau abaixo de suas pontuações no trabalho diário com agentes. Um deles o descreveu como ficando atrás do Kimi K3 na prática, apesar da liderança nos benchmarks, e outros fizeram avaliações privadas nas quais ele ficou "nem de perto" do Fable 5. Uma observação comum: ele é rápido, às vezes suspeitamente rápido, e sua saída de design de frontend fica em torno do nível do GLM-5.2, em vez de estar na fronteira. Essa diferença entre ranking e experiência é o que vale observar quando os weights estiverem abertos e qualquer um puder reproduzir os testes.

Como identificar o momento em que os pesos são reais

"Em breve" se tornará "lançado" por meio de artefatos concretos, não de outro anúncio. Fique atento a tudo isso antes de tratar o Qwen3.8 como um modelo de peso aberto sobre o qual você pode construir:

  • Um anúncio oficial de lançamento da Alibaba/Qwen apontando para um download, e não apenas uma publicação de “em breve”.
  • Um repositório no Hugging Face com arquivos de pesos reais sob a organização Qwen da Alibaba, além de um arquivo de licença que você tenha lido (pesos abertos e licenças de código aberto não são a mesma coisa).
  • Um model card que liste os parâmetros ativos, o comprimento de contexto e as modalidades, e não apenas o total de 2,4T.
  • Benchmarks de terceiros de alguém que não seja a Alibaba, executados nos pesos lançados em vez da prévia.
  • Preços estáveis de API para a versão hospedada, para que você possa comparar o custo por token com o Kimi K3 e o Claude.

Se você está escolhendo um modelo para construir hoje, nosso resumo dos melhores LLMs de código de código aberto cobre opções cujos pesos já podem ser baixados. Assim que os pesos do Qwen3.8 e uma API estável forem lançados, ele também poderá ser acessado por meio de gateways de API compatíveis com Anthropic, como o AIReiter, junto com os outros modelos de fronteira, para que você possa fazer testes A/B contra seu modelo atual sem reescrever sua integração.

Perguntas Frequentes

O Qwen é open weight?

Modelos Qwen anteriores foram lançados com pesos abertos, mas cada versão é uma decisão separada. Os pesos do Qwen3.8 são prometidos, mas ainda não foram disponibilizados, e os dois navios-chefe mais recentes da Alibaba permaneceram fechados no lançamento, então "Qwen é aberto" não se aplica automaticamente ao 3.8.

O Qwen3.8 é gratuito para uso?

Agora não. O Qwen3.8-Max-Preview está atrás do Plano de Tokens pago da Alibaba Cloud e das plataformas Qoder. O app gratuito Qwen Chat ainda usa o Qwen3.7-Plus mais antigo.

Qwen3.8 é melhor que DeepSeek ou Claude?

Nas pontuações do KingBench 3 relatadas pela comunidade, o Qwen3.8-Max supera por pouco o Opus 4.8 e fica atrás do Fable 5. Mas essas são alegações não verificadas, e vários testadores constataram que seu desempenho de agente no mundo real ficou abaixo de sua posição no benchmark. Ainda não há um confronto independente direto com o DeepSeek V4 ou o Claude nas weights lançadas, porque as weights não foram lançadas.

Qual é a data de lançamento do Qwen3.8 open-weights?

A Alibaba só disse "em breve". Vazamentos do dia do lançamento apontam para uma estreia no fim de julho de 2026, e um relato de segunda mão no Reddit sugere agosto. Nenhuma data definitiva foi confirmada pela Alibaba.