Actualités / Model Watch · LLM
Qwen3.8-Max : le modèle phare d’Alibaba à ~2,4T — pas un nouveau générateur vidéo
Début août 2026, l’équipe Qwen d’Alibaba a mis Qwen3.8-Max sur le devant de la scène comme le modèle le plus performant de la famille Qwen à ce jour (les présentations publiques évoquent environ 2,4 trillions de paramètres). Ce récapitulatif s'adresse aux développeurs d'API — et vise à dissiper une confusion fréquente avec Qwen2.5-VL / Qwen2-VL.
Mise à jour (21 août 2026) : les poids ouverts « à venir » sont disponibles — Qwen3.8-2.4T-A95B (+FP8) et la version Apache-2.0 27B sont sur Hugging Face. Les noms des dépôts, les détails de licence et un guide d'exécution en local sont fournis dans le récapitulatif de suivi.
Oui — mérite un article Model Watch en tant que mise à jour LLM / agent phare. Non — ne publiez pas « Alibaba vient de sortir Qwen2-VL-72B / Qwen2.5-VL comme modèle vidéo équivalent à Seedance ». Qwen2.5-VL est une gamme de compréhension vision-langage (analyser des images, comprendre de longues vidéos, piloter des interfaces) issue d'un cycle de publication antérieur — une mission bien différente de la génération vidéo de Seedance 2.5 ou MiniMax H3.
Ce qu'est Qwen3.8-Max (d'après les annonces publiques de lancement)
- Modèle de langage phare de l'ère Qwen 3.x — positionnement : code, cas d'usage réels, recherche, tâches à long terme.
- Échelle : les documents et la couverture médiatique mentionnent un ordre de grandeur de ~2,4T paramètres (référez-vous à la documentation officielle pour le nombre exact de paramètres MoE/actifs lors de votre intégration).
- Poids ouverts : lors de la publication (8 août), c'était une promesse ; ils sont arrivés la semaine du 12 au 17 août — 2.4T-A95B (+FP8) et un Apache-2.0 27B sur Hugging Face, avec les précisions sur la licence dans le suivi.
- Disponibilité produit : accès via Qwen Chat / Alibaba Cloud ; les références entreprise/API suivent la nomenclature de la console (les identifiants peuvent différer des noms commerciaux).
Tableau de clarification des noms (rumeur vs réalité)
| Nom véhiculé | Ce que c'est réellement | Génération vidéo ? |
|---|---|---|
| Qwen3.8-Max | LLM phare d'août 2026 (récit des ~2,4T) | Non (axé texte / agents) |
| Qwen2.5-VL | Famille de compréhension vision-langage (gamme 2025+) | Comprend la vidéo ; ne remplace pas les générateurs Seedance/H3 |
| Qwen2-VL-72B | Ancienne déclinaison de taille VL dans la série Qwen2-VL | Idem — modèle VL, pas un modèle phare T2V |
| Qwen3-VL (encodeur dans d'autres architectures) | Utilisé comme encodeur au sein de certains systèmes vidéo (ex. stacks H3 ouvertes) | Rôle de composant ≠ « Alibaba a sorti un modèle vidéo aujourd'hui » |
| Qwen-Image-3.0 | Gamme distincte de génération d'images | Génération d'images, pas de vidéo |
Pourquoi la rumeur se propage sur X
- Les modèles VL « traitent la vidéo » dans les démos (compréhension de vidéos longues) → les gens entendent « modèle vidéo ».
- Les générateurs vidéo intègrent des encodeurs Qwen-VL → « Qwen vient de sortir de la vidéo » dans les discussions informelles.
- Le mois d'août 2026 est très dense (Seedance 2.5, MiniMax H3, Qwen3.8-Max) → les noms de marques s'entremêlent.
Règle ChinaModelAPI : les modèles de génération vidéo (Seedance, H3, HappyHorse…) restent dans la catégorie vidéo ; la compréhension VL et les LLM phares ont droit à leurs propres articles avec des rôles clairement définis.
Check-list pour développeurs
- Si vous recherchez du code / des agents / du chat à long contexte → évaluez Qwen3.8-Max (et les modèles denses 3.x plus compacts en local).
- Si vous recherchez de la compréhension de documents / captures d'écran / vidéos → utilisez une déclinaison Qwen-VL actuelle, et non Max pris à tort pour du T2V.
- Si vous recherchez de la génération texte-vers-vidéo → Seedance / H3 / alternatives similaires ; consultez les synthèses vidéo ci-dessous.
- Attendez les identifiants de modèle officiels sur Alibaba Cloud / les relais compatibles OpenAI avant de figer dans le code les noms commerciaux.
- Les informations d'accès à Qwen sur ChinaModelAPI restent disponibles sur le guide de l'API Qwen ; Max y apparaîtra dès que le routage aura été validé.
FAQ
Max est-il un modèle vidéo ?
Non. C'est un modèle phare de langage et de productivité. Des fonctionnalités multimodales peuvent apparaître via la couche de service — cela ne reste pas pour autant du T2V équivalent à Seedance.
Faut-il mettre à jour le guide Qwen ?
Dès qu'un identifiant stable sera disponible en production sur notre relais, oui. D'ici là, cet article d'actualité et la liste d'attente suffisent.