Modelos e LLMs

Alibaba anuncia Qwen3.8 com 2.4T de parâmetros e prévia paga

A Alibaba promete liberar os pesos do modelo, mas já oferece uma prévia limitada a serviços pagos.

A Alibaba anunciou em 19 de julho de 2026 o Qwen3.8, modelo de linguagem com 2.4T de parâmetros que terá os pesos abertos em breve. Antes disso, a empresa colocou o Qwen3.8-Max-Preview no Token Plan, no Qoder e no QoderWork. A disputa interessa a quem roda modelos localmente, lida com dados sensíveis ou precisa decidir entre um modelo grande e caro e alternativas mais rápidas.

A Alibaba vende a prévia antes de abrir os pesos

O anúncio da Qwen chama o modelo de “um dos mais poderosos disponíveis hoje” e diz que ele fica atrás apenas do Fable 5. A empresa não apresentou, no conteúdo disponível, benchmark, licença, data de publicação dos pesos ou detalhes sobre hardware. O número central é outro: 2.4T de parâmetros, escala que sugere um modelo pesado para operar e difícil de reproduzir localmente sem versões menores.

A prévia chegou a três produtos. O Token Plan atende ao acesso internacional e tem uma página separada para a China; Qoder e QoderWork também receberam o modelo. O post da Qwen não diz que esses serviços oferecem acesso gratuito, mas lebovic observou que “não encontrei uma página de anúncio, mas há um banner no site anunciando o Qwen 3.8 e redirecionando para esta página. Parece que eles estão testando o modelo apenas no plano de assinatura”. A diferença pesa para equipes que querem validar desempenho antes de comprometer orçamento ou integrar uma API.

A promessa de pesos abertos muda o tipo de decisão. Com os pesos, uma equipe pode controlar onde executa o modelo e evitar enviar certos dados para um serviço externo; sem os pesos, precisa aceitar as regras e os limites do produto que hospeda a prévia. O comentário de nsbk resume esse interesse: “Espero que eles lancem tamanhos menores do Qwen3.8. Eu uso os modelos MoE de 35B e denso de 27B localmente e, na maior parte do tempo, não preciso recorrer ao Claude. Muito útil, especialmente quando os pedidos incluem dados sensíveis e/ou pessoais”.

O tamanho cria expectativa, mas também cobra tokens

Os comentários tratam o Qwen3.8 como resposta à corrida por modelos chineses muito grandes. adrian_b escreveu: “Acho que esse anúncio foi motivado pelo anúncio da Moonshot AI, que acaba de anunciar um LLM de open weights com 2.8T de parâmetros, o Kimi K3, que será publicado no Huggingface até 27 de julho. Agora a resposta da Alibaba é que também publicará em breve um grande LLM de open weights, o Qwen 3.8, para competir melhor com a Moonshot AI”. O comentário atribui uma possível motivação estratégica, não uma confirmação da Alibaba.

O debate também separa capacidade de custo operacional. LaurensBER escreveu que “a mudança de modelos de ‘value’ para modelos ‘inteligentes, enormes e lentos’ vindos da China é uma mudança interessante de estratégia”, mas apontou que GLM 5.2 e Kimi 3 “consomem tokens demais e, por isso, parecem mais lentos de usar”. Modelos que geram mais tokens podem aumentar o tempo de resposta e o gasto por tarefa, mesmo quando entregam respostas mais elaboradas.

SwellJoe contesta a superioridade anunciada: “O Qwen é o mais censurado dos modelos chineses nos meus testes, o que me faz questionar de que outras formas ele está comprometido. Open weights não revela realmente o que há dentro dele”. Ele também afirmou que, em seus testes, modelos atuais da Qwen não lideram nenhuma métrica e que o DeepSeek V4 Pro foi melhor, mais rápido e mais barato que o Qwen 3.7 Max. Essas são experiências individuais, não uma avaliação controlada publicada pela Alibaba.

O tópico no Hacker News alcançou 961 pontos e 731 comentários, enquanto seis comentários foram coletados para a análise. Os participantes concordam em dois pontos práticos: o tamanho menor será decisivo para uso local, e o consumo de tokens pode anular parte do ganho de capacidade. O que continua aberto é mais importante: a Alibaba ainda não informou quando publicará os pesos, sob qual licença, quais tamanhos oferecerá e se o Qwen3.8 realmente supera o Fable 5 ou as alternativas citadas. Quem escolhe um modelo hoje precisa tratar a promessa como prévia comercial, não como evidência técnica concluída.

Fontes

Modelos e LLMsHacker News
Como fazemos: nossa equipe monitora diariamente os repositórios de código aberto em maior alta e produz esta cobertura com apoio de modelos de linguagem, sempre a partir de dados verificados na fonte primária — repositório, documentação oficial e ranking público. Os números de estrelas e a posição no ranking refletem o momento da coleta. Entenda o método.