ニュース / モデルウォッチ · リリースプレビュー
Qwen3.8-Flash-Next: アリババがQwen4アーキテクチャを前倒し投入 — 今夜オープンウェイト公開
2.4TのMaxおよびノートPCクラスの27Bの公開から2週間、AlibabaのQwenチームは早くも次の一手を打ち出しました。Qwen3.8-Flash-Nextは、将来のQwen4を駆動するアーキテクチャを先行公開するためのオープンウェイト・マルチモーダルMoEであり、ModelScopeのカウントダウンは今夜、北京時間23:00(8月26日)を指しています。
更新(8月27日):予定通りリリースされました — Hugging Face上で重みが公開されています(Qwen/Qwen3.8-Flash-Next、131個のsafetensorsシャード、ゲートなし、FP8版も提供)、さらにテクニカルレポートも公開されました。カウントダウン通りに登場し、以下のスペックはレポートで改訂されない限りプレビュー時の内容のまま維持されます。
Qwen3.8-Flash-Nextは、公式ModelScopeカウントダウンによると8月26日北京時間約23:00にリリースされるオープンウェイトのマルチモーダルMoEです — メインパラメータ125B + N-gram埋め込みパラメータ51B、トークンあたり6Bアクティブ(ティーザーのハイライトより)、GDNハイブリッドアーキテクチャ + Qwen Sparse Attention (QSA)をベースに構築されています。 Qwen側の位置づけ:開発者が事前に準備できるよう、Qwen4アーキテクチャを早期に提供すること。ベンチマーク、ライセンス、コンテキスト長:プレビュー時点では未公開。
確定事項と未確定事項
- 確定事項(ティーザー + Qwenの発表):オープンウェイトでのリリース、マルチモーダルMoE、2つの目玉となるアーキテクチャ変更(GDNハイブリッドアーキテクチャおよびQwen Sparse Attention)、ModelScope上でのリリース予定時刻は2026-08-26 23:00 (UTC+08)、Qwen4ファミリーのアーキテクチャプレビューとしての位置づけ。
- ティーザーのハイライトによる情報:メインモデルのパラメータ125B、高速なローカルトークンルックアップ用の補助的な51B N-gram埋め込みテーブル、トークンあたり6Bのアクティブパラメータ — アテンション、残差接続、埋め込み、最適化の全体にわたるアップグレードが施された「再設計されたマルチモーダルMoE」。
- 未公開の項目:ベンチマーク、ライセンス、コンテキストウィンドウ、ホスティング料金、正確なリポジトリ名。NVIDIAフォーラムではサイズを35B-A3Bと解釈する懐疑的な見方もあります — 125B-A6Bの数値はティーザーページ自体に由来しますが、リポジトリが公開されるまではすべてプレリリース情報として扱う必要があります。
- 今夜の注目リンク:Qwen Hugging Face OrgおよびModelScopeカウントダウンページ。明日、検証済みのスペックを追って報告します。
注目の理由:単なる追加チェックポイントではなく、次世代アーキテクチャの先行版
- Qwen4を先取り体験。オープンリリースでのGDN + QSAの提供により、コミュニティはフラッグシップファミリーの登場よりも数か月早く、Qwen4のサービング効率(アテンションコスト、長文脈動作)をベンチマークできます。
- ローカル実行派にとっての注目点はトークンあたり6Bのアクティブパラメータ。効率性に関する主張が正しければ、(すでにNVIDIAフォーラムで話題の)DGX SparkクラスのハードウェアやハイエンドMacが現実的なホストになります — これは27Bをヒットさせたのと同じ展開です。
- 異例となる51BのN-gram埋め込みテーブルは要注目の興味深いポイントです。高速なローカルトークンルックアップを第一級の設計要素とすることはこのクラスでは新しく、ローカルサービングに必要なメモリフットプリントの計算には実際のリポジトリの確認が必要です。
- 背景:Maxのオープンウェイト公開(8月12日)、27B(8月14日)、そして今回のアーキテクチャ先遣隊と、3週間にわたるQwenの猛攻を締めくくるものです。一方で、Ox Alphaの謎も中国系研究所によるステルスリリースへの注目を集め続けています。
一次情報源
- ModelScope 公式カウントダウンページ — Qwen3.8-Flash-Next「Upcoming Open-Release」、2026-08-26 23:00 (UTC+08) 公開予定
- XのAGTP — QwenチームによるQwen4予告の分析(125B+51B/A6B、GDN+QSA、「開発者の事前準備のためにアーキテクチャを先行公開」)
- OrcaRouter — Qwen3.8-Flash-Next ダッシュボード(確定/噂の区分 + カウントダウンのスクリーンショット)
- NVIDIA Developer Forums — DGX Spark ディスカッションスレッド(ハイライト原文の引用と125Bへの疑問点を含む)
- Hacker News — Qwen 3.8-Flash-Next releasing tomorrow(308ポイントのスレッド)
よくあるご質問 (2026)
概要は?
Qwen4のアーキテクチャを先行公開するオープンウェイトのマルチモーダルMoE — ModelScopeのカウントダウンは8月26日北京時間23:00を指しています。
スペックは?
ティーザーのハイライトによると:メイン125B + 51B N-gram埋め込み、トークンあたり6Bアクティブ、GDNハイブリッドアーキテクチャ + Qwen Sparse Attention。
公開時期は?
8月26日に予定通りリリース — 8月27日にHF上で重みの公開を確認(131シャード + FP8版、ゲートなし)、テクニカルレポート公開済み。
注目の理由は?
6BのアクティブパラメータによるQwen4のサービング効率(GDN+QSA)の初のオープンな体験 — 主張通りであればエッジやローカル環境にも適しています。
未確定な情報は?
ベンチマーク、ライセンス、コンテキスト長、価格設定。サイズに関しても懐疑的な見方(35B-A3Bという解釈)があるため、すべての数値はプレリリース情報として扱う必要があります。
Maxや27Bとの違いは?
Max (2.4T) = フラッグシップ、27B = ノートPCでの常用向け、Flash-Next = Qwen4アーキテクチャの先遣隊。同世代で3つの異なる役割を担っています。