A conta oficial da Qwen, da Alibaba, anunciou o Qwen3.8-Max-Preview no X em 19 de julho de 2026 e prometeu os open weights para "em breve", sem informar uma data. Em outras palavras: o modelo que dá para experimentar hoje é um preview hospedado, não um download. É a liberação dos pesos que realmente interessa a muita gente — e, por enquanto, o cronograma é contraditório. Além disso, o chamativo número de 2,4 trilhões de parâmetros esconde justamente o dado mais importante. Há poucos detalhes confirmados, os vazamentos apontam para três prazos diferentes e a métrica que define o custo no mundo real ainda não foi divulgada.
O que é, de fato, o Qwen3.8-Max-Preview
O Qwen3.8-Max-Preview é a versão hospedada e de acesso antecipado do próximo modelo principal da Alibaba. A conta da Qwen descreve o modelo como totalmente multimodal, com 2,4 trilhões de parâmetros — reunindo texto, imagens e mais modalidades em um único modelo — e o posiciona como "segundo apenas" ao Claude Fable 5, da Anthropic.
Já é possível testá-lo, mas apenas em lugares específicos: na assinatura Token Plan do Alibaba Cloud e nas plataformas agênticas Qoder e QoderWork. Ele não é o padrão no aplicativo web gratuito Qwen Chat, que continua carregando o Qwen3.7-Plus, da geração anterior.
O termo "Preview" deve ser levado ao pé da letra. A Alibaba afirma que as capacidades do modelo continuarão mudando durante esse período, portanto qualquer pontuação ou comportamento observado hoje pode ser diferente quando os pesos forem lançados.
O teste secreto "Kaleb" que antecipou a novidade
O preview não surgiu do nada. Antes da revelação oficial, testadores no X notaram que o Qwen3.8-Max rodava na arena pública de comparação de modelos LMArena sob o codinome secreto "Kaleb". Laboratórios usam nomes anônimos para coletar votos cegos em comparações diretas antes de associar sua marca a um modelo.
Esse detalhe importa por um motivo: os primeiros comentários sobre a força do modelo na geração de código frontend vieram desses confrontos cegos do Kaleb, não do marketing da Alibaba. Até agora, é o sinal mais próximo de uma validação externa. Ainda assim, ninguém publicou um resultado arquivado do Kaleb que confirme a identidade, então vale encarar isso como uma alegação forte da comunidade, não como prova.
Quando saem os open weights do Qwen3.8?
Há três cronogramas em circulação, e eles não batem:
| Fonte | Prazo alegado |
|---|---|
| Alibaba Qwen, publicação oficial no X | "Open-weight em breve", sem data |
| Publicações com vazamentos no X no dia do lançamento | Lançamento global até o fim de julho de 2026 |
| Reddit r/Qwen_AI (relato de segunda mão, funcionário da Alibaba em uma conferência em Paris) | Agosto de 2026 |
"Em breve", "fim de julho" e "agosto" não são a mesma promessa. A previsão para o fim de julho vem de publicações com vazamentos no X no dia do lançamento. Já agosto é um relato indireto, publicado no Reddit, sobre o comentário de um funcionário da Alibaba; por isso, é o mais frágil dos três sinais.
Há também um problema de histórico. Os dois Max principais mais recentes da Alibaba não tiveram os pesos abertos no primeiro dia, e a geração anterior permaneceu fechada por algum tempo após o lançamento. Uma promessa de open weights vinculada a um preview continua sendo apenas uma promessa, não uma liberação.
Como comparação, a Moonshot associou uma data específica no calendário aos pesos do Kimi K3 concorrente, em vez de usar um vago "em breve". A data exata e os cálculos de hardware estão na nossa análise sobre os open weights do Kimi K3. O Qwen3.8 ainda não tem uma data concreta equivalente.
Por que 2,4T não é o número decisivo
Os "2,4 trilhões de parâmetros" viram manchete, mas, em um modelo mixture-of-experts (MoE), esse é o dado menos útil. Modelos MoE direcionam cada token por apenas uma fração dos parâmetros totais — os chamados "parâmetros ativos" por token. Por isso, a contagem total quase não informa sobre velocidade ou custo de operação.
A Alibaba não divulgou a quantidade de parâmetros ativos. Sem esse número, não dá para estimar o custo de execução do modelo, sua velocidade ou qual hardware será necessário para hospedar uma cópia localmente. Um total de 2,4T pode ativar de dezenas a algumas centenas de bilhões de parâmetros por token, e cada cenário tem implicações de custo muito diferentes.
Essa é a principal lacuna para quem planeja fazer self-hosting. Um testador no X brincou que seriam necessárias várias placas RTX 6000 Pro para rodar uma versão quantizada em 4 bits, mas isso seguirá sendo especulação até que o número de parâmetros ativos e os arquivos de pesos de fato existam.
O que os primeiros testadores estão encontrando
Como o preview está no ar, já há reações de primeira mão — e elas mostram uma divisão clara entre benchmarks e uso prático.
No lado dos benchmarks, números do KingBench 3 relatados pela comunidade colocam o Qwen3.8-Max acima do Opus 4.8 e do Kimi K3, com apenas o Fable 5 à frente. Um desenvolvedor que publica como @Leo_R_UK no X afirmou que uma suíte de seis tarefas para agentes de código, executada pela API direta, marcou 59/60: o maior resultado que havia registrado.
Esse gráfico deve ser tratado como uma alegação de fornecedor e comunidade, não como uma verificação independente. A Alibaba não publicou tabelas oficiais de benchmark; portanto, cada número é uma afirmação própria ou uma avaliação feita por usuário em uma amostra pequena.
Os relatos de uso real são mais contidos. Testadores como @synthwavedd e @VoltraceGG no X disseram que o modelo parece ficar um degrau abaixo de suas pontuações no trabalho diário com agentes. Um deles afirmou que, na prática, ele fica atrás do Kimi K3 apesar da liderança nos benchmarks; outros rodaram avaliações privadas nas quais ele ficou "nem remotamente perto" do Fable 5. Uma observação recorrente: ele é rápido, às vezes rápido até demais, e sua produção de design frontend se aproxima do nível do GLM-5.2, em vez de chegar à fronteira. Essa diferença entre placar e experiência é o que vale acompanhar quando os pesos estiverem abertos e qualquer pessoa puder reproduzir os testes.
Como confirmar que os pesos realmente foram liberados
"Em breve" só passará a significar "lançado" quando houver artefatos concretos, não mais um anúncio. Antes de considerar o Qwen3.8 um modelo de open weights no qual é possível construir, procure todos estes sinais:
- Um anúncio oficial de lançamento da Alibaba/Qwen com link para download, não apenas uma publicação dizendo "em breve".
- Um repositório no Hugging Face com arquivos de pesos reais na organização Qwen da Alibaba, além de um arquivo de licença que você tenha lido — open weights e licenças open source não são a mesma coisa.
- Um model card com os parâmetros ativos, o tamanho de contexto e as modalidades, não somente o total de 2,4T.
- Benchmarks de terceiros feitos por alguém que não seja a Alibaba, usando os pesos lançados em vez do preview.
- Preços estáveis de API para a versão hospedada, permitindo comparar o custo por token com Kimi K3 e Claude.
Se você precisa escolher hoje um modelo para desenvolver, nossa seleção dos melhores LLMs open source para programação reúne opções cujos pesos já podem ser baixados. Quando os pesos do Qwen3.8 e uma API estável chegarem, ele também poderá ser acessado por gateways de API compatíveis com Anthropic, como o AIReiter, ao lado dos demais modelos de fronteira. Assim, será possível compará-lo em testes A/B com o modelo atual sem reescrever sua integração.
Perguntas frequentes
Qwen tem open weights?
Modelos Qwen anteriores foram lançados com open weights, mas cada lançamento é uma decisão separada. Os pesos do Qwen3.8 foram prometidos, mas ainda não saíram, e os dois principais modelos mais recentes da Alibaba permaneceram fechados no lançamento. Portanto, dizer que "Qwen é aberto" não se aplica automaticamente ao 3.8.
O Qwen3.8 é gratuito?
Por enquanto, não. O Qwen3.8-Max-Preview está disponível apenas no Token Plan pago do Alibaba Cloud e nas plataformas Qoder. O aplicativo gratuito Qwen Chat continua rodando o Qwen3.7-Plus mais antigo.
O Qwen3.8 é melhor que DeepSeek ou Claude?
Nas pontuações do KingBench 3 relatadas pela comunidade, o Qwen3.8-Max supera por pouco o Opus 4.8 e fica atrás do Fable 5. Mas são alegações não verificadas, e vários testadores consideraram seu desempenho prático com agentes inferior à posição nos benchmarks. Ainda não existe uma comparação independente direta com DeepSeek V4 ou Claude usando os pesos lançados, porque os pesos ainda não foram liberados.
Qual é a data de lançamento dos open weights do Qwen3.8?
A Alibaba disse apenas "em breve". Vazamentos do dia do lançamento apontam para uma liberação no fim de julho de 2026, enquanto um relato indireto no Reddit sugere agosto. A Alibaba não confirmou nenhuma data concreta.