新闻 / 模型速递 · LLM
Qwen3.8-Max:阿里 ~2.4T 旗舰 —— 并非全新视频生成模型
2026 年 8 月初,阿里 Qwen 团队推出了 Qwen3.8-Max,作为迄今为止 Qwen 家族能力最强的模型(公开资料显示其参数量约为 2.4 万亿)。 本篇简报专为 API 开发者打造 —— 并澄清其与 Qwen2.5-VL / Qwen2-VL 之间常见的混淆传闻。
更新(2026 年 8 月 21 日):此前预告的开源权重现已发布 —— Qwen3.8-2.4T-A95B(+FP8)与 Apache-2.0 协议的 27B 已上线 Hugging Face。仓库名称、许可证详细条款以及本地运行指南均包含在后续简报中。
是的 —— 值得发一篇模型速递作为 LLM / Agent 旗舰更新。 不是 —— 请勿发布“阿里刚刚发布了 Qwen2-VL-72B / Qwen2.5-VL 作为 Seedance 级别的视频模型”这种说法。 Qwen2.5-VL 是早期发布周期中的视觉语言理解产品线(看图、长视频理解、UI 操控)—— 分工与 Seedance 2.5 或 MiniMax H3 的视频生成截然不同。
Qwen3.8-Max 到底是什么(整理自官方公开资料)
- 旗舰语言模型,处于 Qwen 3.x 时代 —— 定位:代码编写、实际生产工作、科学研究、长流程复杂任务。
- 模型规模:官方资料与报道显示参数量在 ~2.4T 参数量级(接入时请以官方文档公布的具体 MoE/激活参数量为准)。
- 开源权重:发布初(8 月 8 日)仍为预告;随后在 8 月 12–17 日当周正式落地 —— 2.4T-A95B(+FP8)以及 Apache-2.0 协议的 27B 已上线 Hugging Face,许可证细则见后续更新。
- 产品形态:提供 Qwen Chat / 阿里云服务调用路径;企业级/API SKU 遵循控制台命名规范(模型 ID 可能与宣传名称不同)。
名称辨析表(传闻 vs 事实)
| 坊间称呼 | 实际定位 | 是否支持视频生成? |
|---|---|---|
| Qwen3.8-Max | 2026 年 8 月旗舰 LLM(约 2.4T 参数口径) | 否(主打文本与 Agent) |
| Qwen2.5-VL | 视觉语言理解系列(2025 起的产品线) | 支持视频理解;不可替代 Seedance/H3 视频生成模型 |
| Qwen2-VL-72B | Qwen2-VL 系列中的早期尺寸版本 | 同上 —— 属于 VL,而非文生视频(T2V)旗舰 |
| Qwen3-VL(其他技术栈中的编码器) | 在部分视频系统中作为编码器使用(例如开源 H3 技术栈) | 仅作为组件角色 ≠ “阿里今天发布了视频模型” |
| Qwen-Image-3.0 | 独立的图像生成产品线 | 图像生成,非视频生成 |
传闻为何在 X 上扩散
- VL 模型在演示中“支持视频”(长视频理解)→ 用户误听为“视频模型”。
- 视频生成器加载了 Qwen-VL 编码器 → 闲聊中被传为“Qwen 刚刚推出了视频模型”。
- 2026 年 8 月发布密集(Seedance 2.5、MiniMax H3、Qwen3.8-Max)→ 品牌名称容易混淆。
ChinaModelAPI 规范:视频生成模型(Seedance、H3、HappyHorse……)归入视频分类; VL 理解与 LLM 旗舰则分别单独立帖,并明确标注职能分工。
开发者落地清单
- 如需 代码编写 / Agent / 长上下文对话 → 建议评估 Qwen3.8-Max(本地部署可选用更小的 3.x Dense 稠密模型)。
- 如需 文档 / 截图 / 视频理解 → 请使用现有的 Qwen-VL SKU,而非把 Max 当作文生视频模型。
- 如需 文生视频 → 请选用 Seedance / H3 等模型;详见下方链接的视频专题简报。
- 在代码中硬编码宣传名称前,请等待阿里云 / OpenAI 兼容中转平台上的官方模型 ID。
- ChinaModelAPI 的 Qwen 接入说明请参考 Qwen API 指南;Max 将在路由健康检查通过后上线。
FAQ
Max 是视频模型吗?
不是。它是旗舰语言 / 生产力模型。多模态特性可能通过服务端架构提供 —— 但依然不是 Seedance 级别的文生视频模型。
我们需要更新 Qwen 指南吗?
当中转平台提供稳定的生产环境模型 ID 后,会进行更新。在此之前,以本篇新闻动态及候补名单为准即可。