الأخبار / متابعة النماذج · معاينة الإصدار
Qwen3.8-Flash-Next: تطلق Alibaba معمارية Qwen4 مبكراً — أوزان مفتوحة الليلة
بعد أسبوعين من إتاحة نموذج 2.4T Max ونموذج 27B المخصص للحواسيب المحمولة، يستعد فريق Qwen التابع لـ Alibaba بالفعل للمرحلة التالية: Qwen3.8-Flash-Next، وهو نموذج MoE متعدد الوسائط ومفتوح الأوزان وظيفته تقديم معاينة للمعمارية التي ستشغل Qwen4 — مع عد تنازلي على ModelScope يشير إلى الليلة، 23:00 بتوقيت بكين (26 أغسطس).
تحديث (27 أغسطس): صَدَر في الموعد المحدد — الأوزان متاحة الآن على Hugging Face (Qwen/Qwen3.8-Flash-Next، 131 ملف safetensors مجزأ، غير مقيد، بالإضافة إلى إصدار FP8)، والتقرير التقني متاح الآن. لقد اكتمل العد التنازلي؛ والمواصفات أدناه تظل كما عُرضت ما لم يعدلها التقرير.
Qwen3.8-Flash-Next هو نموذج MoE متعدد الوسائط ومفتوح الأوزان يصدر في 26 أغسطس قرابة 23:00 بتوقيت بكين وفقاً للعد التنازلي الرسمي على ModelScope — 125B معلمة رئيسية + 51B معلمة تضمين N-gram، مع 6B معلمات نشطة لكل رمز (وفقاً لأبرز ما ورد في الإعلان التشويقي)، مبني على معمارية GDN الهجينة + Qwen Sparse Attention (QSA). رؤية Qwen: إطلاق معمارية Qwen4 مبكراً لتمكين المطورين من الاستعداد. اختبارات الأداء، والترخيص، وطول سياق النص: لم تُنشر وقت المعاينة.
ما تم تأكيده مقابل ما لم يتم تأكيده
- المؤكد (الإعلان التشويقي + بيان Qwen): إصدار مفتوح الأوزان؛ نموذج MoE متعدد الوسائط؛ أبرز تغييرين في المعمارية — معمارية GDN الهجينة وQwen Sparse Attention؛ موعد الإصدار المتوقع 2026-08-26 23:00 (UTC+08) على ModelScope؛ التقديم كمعاينة لمعمارية عائلة Qwen4.
- وفقاً لأبرز ما ورد في الإعلان التشويقي: 125B معلمة للنموذج الرئيسي، وجدول تضمين N-gram تكميلي بحجم 51B لعمليات البحث السريع عن الرموز محلياً، و6B معلمات نشطة لكل رمز — "نموذج MoE متعدد الوسائط مُعاد تصميمه"، مع ترقيات تشمل الانتباه والوصلات المتبقية والتضمين والتحسين.
- لم يُنشر بعد: اختبارات الأداء، والترخيص، ونافذة السياق، وأسعار الاستضافة، وأسماء المستودعات الدقيقة. يرى أحد المشككين في منتدى NVIDIA أن الحجم هو 35B-A3B بدلاً من ذلك — يعود رقم 125B-A6B إلى صفحة الإعلان التشويقي نفسها، لكن يُفضل التعامل مع كل شيء على أنه غير نهائي قبل الإطلاق حتى يتوفر المستودع رسمياً.
- أين تتابع الليلة: صفحة منظمة Qwen على Hugging Face وصفحة العد التنازلي على ModelScope. سنوافيكم بالمواصفات المؤكدة غداً.
لماذا يمثل هذا أهمية: استكشاف للمعمارية، وليس مجرد نقطة تدريب أخرى
- أول تجربة لـ Qwen4. إن وجود GDN + QSA في إصدار مفتوح يعني أن المجتمع التقني سيتمكن من تقييم الجوانب الاقتصادية لتشغيل Qwen4 (تكلفة الانتباه، وسلوك السياق الطويل) قبل أشهر من إطلاق العائلة الرائدة.
- تفعيل 6B لكل رمز هو الميزة الأبرز للتشغيل المحلي. إذا ثبتت صحة ادعاءات الكفاءة، فستصبح أجهزة فئة DGX-Spark (التي تشهد نقاشاً واسعاً في منتديات NVIDIA) وأجهزة Mac المتطورة خيارات تشغيل واقعية — وهو نفس النهج الذي حقق نجاحاً كبيراً لنموذج 27B.
- جدول تضمين N-gram غير المألوف بحجم 51B هو النقطة الأكثر إثارة للتساؤل: فالاعتماد على البحث المحلي السريع عن الرموز كعنصر تصميمي أساسي يُعد أمراً جديداً في هذه الفئة، وسيتطلب حساب استهلاك الذاكرة اللازم للتشغيل المحلي فحص المستودع الفعلي.
- السياق: يأتي هذا تتويجاً لثلاثة أسابيع متتالية من إطلاقات Qwen — فتح أوزان Max (12 أغسطس)، ونموذج 27B (14 أغسطس)، والآن النموذج الاستكشافي للمعمارية — في حين يواصل غموض نموذج Ox Alpha تسليط الضوء على نمط الإطلاقات الهادئة للمختبرات الصينية.
المصادر الأولية
- صفحة العد التنازلي الرسمية على ModelScope — Qwen3.8-Flash-Next "Upcoming Open-Release"، المتوقع في 2026-08-26 23:00 (UTC+08)
- AGTP على X — تحليل إعلان Qwen4 التشويقي من فريق Qwen (125B+51B/A6B، GDN+QSA، "إتاحة المعمارية مبكراً لتمكين المطورين من الاستعداد")
- OrcaRouter — لوحة معلومات Qwen3.8-Flash-Next (أعمدة المؤكد/الشائعات + لقطة شاشة للعد التنازلي)
- منتديات مطوري NVIDIA — سلسلة نقاشات DGX Spark (تتضمن اقتباسات من أبرز النقاط الأصلية والتشكيك في حجم 125B)
- Hacker News — إصدار Qwen 3.8-Flash-Next غداً (منشور بـ 308 نقاط)
الأسئلة الشائعة (2026)
ما هو؟
نموذج MoE متعدد الوسائط ومفتوح الأوزان يستعرض معمارية Qwen4 — يشير العد التنازلي على ModelScope إلى 26 أغسطس، 23:00 بتوقيت بكين.
المواصفات؟
وفقاً لأبرز ما ورد في الإعلان التشويقي: 125B معلمات رئيسية + 51B تضمينات N-gram، مع 6B معلمات نشطة لكل رمز؛ معمارية GDN الهجينة + Qwen Sparse Attention.
متى؟
صَدَر في الموعد المحدد في 26 أغسطس — تم التحقق من توفر الأوزان على HF في 27 أغسطس (131 ملفاً مجزأً + FP8، بدون قيود)، ونُشر التقرير التقني.
ما أهميته؟
أول تجربة مفتوحة للجوانب الاقتصادية لتشغيل Qwen4 عبر تقنيتي (GDN+QSA) مع 6B معلمات نشطة — ملائم للأجهزة الطرفية والتشغيل المحلي إذا صحت الادعاءات.
ما الذي لم يُؤكَّد بعد؟
اختبارات الأداء، والترخيص، وسياق النص، والأسعار. حتى الحجم هناك من يشكك فيه (قراءة تشير إلى 35B-A3B) — تعامل مع جميع الأرقام على أنها غير نهائية قبل الإطلاق الرسمي.
مقارنة بـ Max و27B؟
Max بحجم (2.4T) = النموذج الرائد؛ 27B = المخصص للاستخدام اليومي على الحواسيب المحمولة؛ Flash-Next = مستكشف معمارية Qwen4. نفس الجيل، وثلاث مهام مختلفة.