Notícias / Model Watch · LLM
Qwen3.8-Max: O flagship de ~2.4T da Alibaba — Não é um novo gerador de vídeo
No início de agosto de 2026, a equipe do Qwen da Alibaba colocou o Qwen3.8-Max sob os holofotes como o modelo mais capaz da família Qwen até o momento (materiais públicos citam cerca de 2,4 trilhões de parâmetros). Este resumo é para desenvolvedores de API — e para desmentir uma confusão comum com o Qwen2.5-VL / Qwen2-VL.
Atualização (21 de ago. de 2026): os pesos abertos "prometidos" foram lançados — Qwen3.8-2.4T-A95B (+FP8) e o 27B com Apache-2.0 estão no Hugging Face. Nomes dos repositórios, detalhes da licença e um guia de execução local estão no resumo complementar.
Sim — vale um post no Model Watch como uma atualização de LLM / agente flagship. Não — não publique “A Alibaba acabou de lançar o Qwen2-VL-72B / Qwen2.5-VL como um modelo de vídeo da categoria do Seedance.” O Qwen2.5-VL é uma linha de compreensão de visão e linguagem (ver imagens, compreender vídeos longos, controlar interfaces) de um ciclo de lançamento anterior — uma função diferente da geração de vídeo do Seedance 2.5 ou do MiniMax H3.
O que é o Qwen3.8-Max (segundo materiais públicos de lançamento)
- Modelo de linguagem flagship na era Qwen 3.x — posicionamento: programação, trabalho no mundo real, pesquisa e tarefas de longo prazo.
- Escala: materiais e cobertura citam na ordem de ~2.4T de parâmetros (trate as contagens exatas de MoE/ativos conforme a documentação oficial ao integrar).
- Pesos abertos: na publicação (8 de ago.), isso era uma promessa; chegou na semana de 12 a 17 de ago. — 2.4T-A95B (+FP8) e um 27B com Apache-2.0 no Hugging Face, com detalhes da licença no resumo seguinte.
- Disponibilização do produto: rotas de serviço do Qwen Chat / Alibaba Cloud; SKUs corporativos/API seguem a nomenclatura do console (os IDs podem diferir dos nomes de marketing).
Tabela de esclarecimento de nomes (boato vs. fato)
| Nome que as pessoas dizem | O que realmente é | Geração de vídeo? |
|---|---|---|
| Qwen3.8-Max | LLM flagship de ago. de 2026 (narrativa de ~2.4T) | Não (foco em texto/agentes) |
| Qwen2.5-VL | Família de compreensão de visão e linguagem (linha de 2025+) | Compreende vídeo; não substitui geradores como Seedance/H3 |
| Qwen2-VL-72B | Classe de tamanho de VL mais antiga da série Qwen2-VL | O mesmo — VL, não um flagship T2V |
| Qwen3-VL (encoder em outras stacks) | Usado como encoder dentro de alguns sistemas de vídeo (ex.: stacks abertas do H3) | Papel de componente ≠ “A Alibaba lançou um modelo de vídeo hoje” |
| Qwen-Image-3.0 | Linha separada de geração de imagens | Imagens, não geração de vídeo |
Por que o boato se espalha no X
- Modelos VL “fazem vídeo” em demonstrações (compreensão de vídeos longos) → as pessoas ouvem “modelo de vídeo”.
- Geradores de vídeo carregam encoders Qwen-VL → “Qwen acabou de lançar vídeo” em conversas informais.
- Agosto de 2026 está agitado (Seedance 2.5, MiniMax H3, Qwen3.8-Max) → os nomes das marcas se misturam.
Regra da ChinaModelAPI: modelos de geração de vídeo (Seedance, H3, HappyHorse…) ficam no cluster de vídeo; compreensão VL e destaques LLM ganham seus próprios posts com funções explícitas.
Lista de verificação para desenvolvedores
- Se você precisa de programação / agentes / chat com contexto longo → avalie o Qwen3.8-Max (e modelos densos menores da linha 3.x para uso local).
- Se você precisa de compreensão de documentos / capturas de tela / vídeo → use um SKU atual do Qwen-VL, e não o Max como T2V.
- Se você precisa de geração de texto para vídeo → Seedance / H3 / similares; veja os resumos de vídeo nos links abaixo.
- Aguarde os IDs de modelo oficiais no Alibaba Cloud / relays compatíveis com OpenAI antes de fixar nomes de marketing no código.
- As notas de acesso ao Qwen da ChinaModelAPI continuam no guia da API Qwen; o Max aparecerá assim que o roteamento passar no teste de integridade.
FAQ
O Max é um modelo de vídeo?
Não. Modelo flagship de linguagem / trabalho. Recursos multimodais podem surgir via stack de serviço — ainda assim não é um T2V da categoria do Seedance.
Devemos atualizar o guia do Qwen?
Quando houver um ID estável de produção no nosso relay, sim. Até lá, este post de notícias + lista de espera é suficiente.