الأخبار / متابعة النماذج · إطلاق الأوزان المفتوحة
أوزان Qwen3.8 المفتوحة (2026): Alibaba تطلق نقاط فحص 2.4T Max — ونموذج 27B بترخيص Apache-2.0 يمكنك تشغيله في المنزل
عندما قدمنا موجزاً عن Qwen3.8-Max في 8 أغسطس، كان الوعد بتوفير الأوزان المفتوحة مجرد ملاحظة هامشية بعنوان "قريباً". والآن أصبح متاحاً: توفر منظمة Qwen على Hugging Face نموذج Qwen3.8-2.4T-A95B (بالإضافة إلى إصدار FP8) — وهو أول نموذج مفتوح الأوزان من فئة Max من أي مختبر — ونموذج Qwen3.8-27B، وهو نموذج 27B كثيف ومرخص بـ Apache-2.0 ويدعم الصور ومقاطع الفيديو ويعمل من ملف بحجم 17GB. يتضمن هذا الموجز الجدول الزمني، وتفاصيل الترخيص الدقيقة، وأسعار API، ودليل تشغيل محلي مجرب عملياً.
أصبحت أوزان Qwen3.8 مفتوحة اعتباراً من 12–17 أغسطس 2026: يُعد Qwen3.8-2.4T-A95B (+ FP8) أول نقطة فحص مفتوحة من فئة Max، كما يأتي Qwen3.8-27B تحت ترخيص Apache 2.0 مع فهم أصلي للصور والفيديو وسياق 262K (قابل للتوسيع إلى 1M).
نموذج 27B هو الذي يمكنك استضافته ذاتياً بالفعل — حيث قام Simon Willison بتشغيله على MacBook بذاكرة 128GB بسرعة 15–30 tok/s ووصفه بأنه "أفضل رسم SVG لبجعة تمكنت من توليده حتى الآن باستخدام نموذج يعمل على جهاز محلي."
أسعار API المستضاف لـ qwen3.8-max وفقاً لتغطية الإطلاق: $2 / $6 / $0.25 لكل 1M رمز (المدخلات / المخرجات / المخزنة مؤقتاً).
من الإعلان إلى الأوزان المفتوحة: الجدول الزمني خلال أسبوعين
| الموعد | ماذا حدث · المصدر |
|---|---|
| أوائل أغسطس (3 أغسطس بحسب CCTV) | الإعلان عن Qwen3.8-Max وتوفيره عبر API — "النموذج الأكثر كفاءة حتى الآن"، مع وعد بالأوزان المفتوحة. غطى موجزنا في 8 أغسطس الإطلاق والخلط الناجم عن الشائعات مع Qwen2.5-VL. |
| أسبوع 12 أغسطس | يمثل منشور المدونة الرسمي "Qwen3.8-Max: A New Bar for Coding and Cowork" أول إصدار مفتوح الأوزان من فئة Max؛ وظهرت نقاط الفحص 2.4T-A95B وFP8 على منظمة Qwen على HF في الأيام التالية (الجداول الزمنية للمجتمع: eigent.ai، codersera). |
| 14–16 أغسطس | صدور Qwen3.8-27B تحت ترخيص Apache 2.0. نشر Simon Willison تجربة عملية (16 أغسطس) تصدرت الصفحة الأولى في Hacker News بـ 798 نقطة؛ وتضع Artificial Analysis نموذج 27B في المركز 52 على مؤشر الذكاء الخاص بها. |
| 17 أغسطس (الإثنين) | CNBC تضعه في مواجهة Meta: "Alibaba ترد على تحدي الذكاء الاصطناعي من Meta بنموذج جديد جاهز للحواسيب المحمولة." وصرحت Hugging Face لـ CNBC بأن المشتقات القائمة على Qwen بلغت 151,448 — أي 2.6 ضعف بصمة Meta. |
تتبع التواريخ المصادر المذكورة في كل صف؛ وعندما تختلف الجداول الزمنية للمجتمع بمقدار يوم واحد (12 مقابل 14 أغسطس لساعات نقطة الفحص الدقيقة)، فإننا نوضح ذلك بدلاً من تسويته وتجاهله.
ما تم إطلاقه، وفقاً لبطاقات النماذج الرسمية
- Qwen3.8-2.4T-A95B (إصدار فئة Max). 2.4 تريليون معامل إجمالاً، مبني على أساس بنية Qwen3.5. تضعه جداول الاختبارات القياسية الرسمية إلى جانب Opus 4.8 وClaude Fable 5 وGPT-5.6 Sol: حيث حقق في Terminal Bench 2.1 نتيجة 86.6 (الحد الأقصى لـ GPT-5.6 Sol هو 88.8)، وفي PaperBench نتيجة 93.0 (أعلى نتيجة في الجدول)، وفي GPQA Diamond نتيجة 92.6، وفي Agents' Last Exam نتيجة 53.6. تم توثيق توافق حزم النماذج مع vLLM وSGLang وTokenSpeed.
- Qwen3.8-27B (النموذج الذي يمكنك تشغيله). نموذج كثيف 27B، بصري لغوي أصلي — صور ومقاطع فيديو — مع تحكم مرن في التفكير، وسياق أصلي يبلغ 262,144 رمزاً قابل للتوسيع إلى 1,000,000. تزعم المواد الترويجية لإطلاق Alibaba أنه "يتفوق على Qwen3.7-Plus عموماً"؛ بينما يعتبره إجماع المجتمع (وفقاً لدليل Qwen من codersera) النموذج المحلي الافتراضي الجديد لـ Qwen بدلاً من Qwen3.6-27B.
- الفارق بين الإصدار المستضاف وإصدار الأوزان مهم للغاية. وفقاً للبطاقة الرسمية، فإن
qwen3.8-max(الإصدار المستضاف) مبني على نقطة فحص 2.4T ويضيف إدخال الرؤية، ووضع عدم التفكير، وسياق 1M افتراضياً، وأدوات مدمجة رسمية. إذا قمت باستضافة نقطة الفحص الخام بنفسك، فأنت تشغل النموذج الأساسي فقط — وليس مجموعة الميزات المستضافة الكاملة. - تم نشر إصدارات FP8 من نقطة الفحص الكبيرة بالتوازي، لفرق الاستدلال في مراكز البيانات التي ترغب في استهلاك أقل للذاكرة.
ما لم يتم إطلاقه — اقرأ التفاصيل الدقيقة
- ترخيص 2.4T ليس Apache (بحسب التقارير). نموذج 27B مرخص بـ Apache 2.0؛ بينما تشير أدلة المجتمع إلى أن مستودعات 2.4T تأتي بموجب ترخيص Qwen مخصص بدلاً من ذلك. حتى 21 أغسطس لم نتمكن من استخراج النص الكامل للترخيص من صفحة المستودع — اقرأ بطاقة النموذج قبل الاستضافة الذاتية التجارية، خاصة إذا كنت تقدم الخدمة خارجياً.
- النسخة المستضافة من 27B: لا موعد ولا سعر. تفيد البطاقة الرسمية بأن النسخة المستضافة من 27B على Qwen Cloud "ستأتي قريباً" بسياق 1M افتراضياً وأدوات مدمجة — دون تفاصيل أكثر تحديداً وقت النشر.
- "2.4T مفتوح" ≠ "2.4T في صندوق GPU الخاص بك." تقدر أدلة المجتمع حجم نقطة فحص FP8 بنحو 2.5TB — وهو نطاق يتطلب عدة عقد. يعد فتح المصدر خطوة استراتيجية ضخمة وذات أهمية عملية لمنصات الاستدلال، وليس لمحطة العمل الخاصة بك.
- مصدر الأسعار. تأتي أرقام $2 / $6 / $0.25 لكل 1M رمز من تغطيات الإطلاق المتسقة (latent.space، eigent.ai، codersera، kie.ai مقابل قائمة Qwen Cloud) — وليس من صفحة أسعار حصلنا عليها مباشرة. تحقق على Model Studio قبل اعتماد الميزانيات.
أسعار API لـ Qwen3.8 مقارنة بمجموعة النماذج الصينية (2026)
بسعر مسجل قدره $2.00 للمدخلات / $6.00 للمخرجات لكل 1M رمز ($0.25 للمدخلات المخزنة مؤقتاً)، يقع qwen3.8-max في نفس النطاق السعري لنظرائه الرائدين — أقل بكثير من النماذج الغربية الرائدة، وأعلى من الحد الأدنى لـ DeepSeek خارج أوقات الذروة.
| النموذج (2026) | الإدخال $/1M | الإخراج $/1M | أوزان مفتوحة |
|---|---|---|---|
| qwen3.8-max | $2.00 | $6.00 | 2.4T-A95B + FP8 على HF (ترخيص مخصص بحسب التقارير) |
| GLM-5.3 (Z.ai) | $1.40 | $4.40 | موعد موعود ~28 أغسطس (موجزنا) |
| deepseek-v4-flash (خارج أوقات الذروة) | $0.22 | $0.66 | MIT (عائلة V4) |
| Kimi K3 | $3.00 | $15.00 | 2.8T، ترخيص معدل (موجزنا) |
تعيد صفوف المقارنة استخدام أسعار تم التحقق منها بالفعل في موجزاتنا السابقة (GLM-5.3، DeepSeek، Kimi K3)؛ أما صف qwen3.8-max فهو مستند إلى تقارير تغطية الإطلاق — انظر التفاصيل الدقيقة أعلاه.
تشغيله في المنزل: طريقة مجربة عملياً من Simon Willison
- الإعداد. ملف GGUF بحجم 17GB بتنسيق
Q4_K_Mفي LM Studio، تم اختباره على جهاز MacBook Pro بذاكرة 128GB (M5 Max) وجهاز NVIDIA DGX Spark — بسرعة تتراوح بين 15–30 رمزاً/ثانية تقريباً، وأسرع بنحو 72% مع فك التشفير التخميني draft-mtp في llama.cpp. - اضبط القيمة الافتراضية للسياق أولاً. يبلغ السياق الأصلي 262,144 رمزاً، لكن القيمة الافتراضية في LM Studio البالغة 8,192 "استُنفدت في التفكير وحده". ارفع هذا الحد قبل أن تحكم على النموذج.
- تخلص من الإفراط في التفكير. مستوى جهد التفكير الافتراضي هو xhigh: استغرق موجه رسم بجعة SVG لديه 21 دقيقة واستهلك 22,276 رمز تفكير لإنتاج 3,223 رمز إخراج. "إنه نموذج رائع، ولكن يا للهول، هذا الإعداد الافتراضي نقطة بداية سيئة" — استخدم مستوى تفكير منخفضاً أو عطل التفكير للمهام اليومية.
- الخلاصة. "أفضل رسم SVG لبجعة تمكنت من توليده حتى الآن باستخدام نموذج يعمل على جهاز محلي" — وفي الرؤية: كانت اختبارات المربعات المحيطة على صور البجع "مطابقة ممتازة للغاية". العيب الوحيد هو سرعة النموذج الكثيف: فهو مقيد بنطاق الذاكرة الترددي، لذا لن يبدو سريعاً مثل نماذج MoE الصغيرة. وكما قال: "إن حقيقة قدرة ملف بحجم 17GB على القيام بكل هذا على أجهزتي المنزلية هي معجزة."
إلى أي إصدار من Qwen3.8 يجب عليك توجيه طلباتك؟
| طبيعة استخدامك | التوجيه إلى | السبب |
|---|---|---|
| التطوير المحلي، الحساس للخصوصية، دون اتصال بالإنترنت | Qwen3.8-27B مستضاف ذاتياً | ترخيص Apache 2.0، وحجم 17GB بتنسيق Q4، ومدخلات صور+فيديو؛ خفّض مستوى التفكير عن xhigh |
| أصعب مهام البرمجة والوكلاء، مستضاف | واجهة API لـ qwen3.8-max | مجموعة الميزات المستضافة الكاملة (إدخال الرؤية، وضع عدم التفكير، 1M افتراضياً، أدوات مدمجة) بسعر $2/$6 |
| أرخص حلقة عمل متينة للنصوص والوكلاء | deepseek-v4-flash | $0.22/$0.66 خارج أوقات الذروة — راجع موجز عائلة Flash الخاص بنا؛ وانتبه لنوافذ الذروة/خارج الذروة الجديدة |
| أوزان مفتوحة من فئة Max، استدلال ذاتي | 2.4T-A95B / FP8 | لمنصات الاستدلال ذات السعة متعددة العقد؛ مع توثيق التوافق مع vLLM/SGLang/TokenSpeed |
كيف استُقبل الخبر: في الخارج وفي الداخل
- أثار Hacker News ضجة واسعة. حصدت مراجعة Willison نحو 798 نقطة؛ وتضيف قائمة Artificial Analysis (المركز 52 في مؤشر الذكاء) موضوعاً حصد 380 نقطة. المواضيع المتكررة: أفضل قدرة محلية في فئتها، والملاحظة الغريبة حول الإعداد الافتراضي xhigh.
- التناول الغربي تمحور حول Meta. ركزت زاوية CNBC على المنافسة مع نماذج Muse Glimmer الجديدة للحواسيب المحمولة من Meta؛ وتثبت إحصائية Hugging Face بوجود 151,448 نموذجاً مشتقاً من Qwen (2.6 ضعف بصمة Meta) هذا الطرح. وتعتبر WIRED وAxios، اللتان غطتا نفس موجة الأوزان المفتوحة هذا الشهر عبر GLM-5.3، النماذج الصينية المفتوحة بمثابة الواجهة الرائدة الافتراضية للذكاء الاصطناعي المفتوح حالياً.
- التغطية الصينية وضعتها ضمن ثلاثية أسبوع واحد. جمع ملخص صحيفة Beijing Business Today الصادر في 16 أغسطس — "一周三更" — بين تعديل أسعار DeepSeek، وفتح المصدر من Alibaba، وخطوة Zhipu في ما بعد التدريب في أسبوع واحد، مع إظهار بيانات OpenRouter أن 6 من أفضل 10 نماذج عالمياً من حيث الاستخدام في ذلك الأسبوع كانت صينية.
احصل على Qwen ومجموعة النماذج الصينية بأكملها عبر نقطة نهاية واحدة متوافقة مع OpenAI
ChinaModelAPI هي خدمة ترحيل مستقلة توفر النماذج الصينية الرائدة — Qwen وDeepSeek وGLM وKimi — للمطورين حول العالم عبر API موحد متوافق مع OpenAI، مع دعم الدفع عبر USDT/USD1 وبدون اشتراكات. إن إطلاقات مثل هذه هي بالضبط ما صُممت المنصة لأجله: توفر النماذج من اليوم الأول، وأسعار شفافة لكل رمز، وتكامل واحد لكافة النماذج.
ChinaModelAPI هي خدمة ترحيل مستقلة ولا تربطها أي علاقة رسمية بشركة Alibaba أو فريق Qwen. يتم التحقق من معرفات النماذج الموجهة بشكل مباشر قبل الإطلاق — انضم إلى قائمة الانتظار لتلقي إشعار عند تفعيل توجيه Qwen3.8.
المصادر الأولية
- مدونة Qwen الرسمية — "Qwen3.8-Max: A New Bar for Coding and Cowork" (أول إصدار مفتوح الأوزان من فئة Max)
- Hugging Face — بطاقة نموذج Qwen/Qwen3.8-2.4T-A95B (الاختبارات القياسية، التوافق مع vLLM/SGLang، الفارق في ميزات النسخة المستضافة Max)
- Hugging Face — بطاقة نموذج Qwen/Qwen3.8-27B (نموذج VLM كثيف، سياق من 262K إلى 1M، النسخة المستضافة "قريباً")
- Hugging Face — منظمة Qwen (460 نموذجاً؛ إدراج إصدار FP8)
- Simon Willison — "Qwen 3.8 27B is excellent, but it defaults to overthinking things" (16 أغسطس 2026)
- CNBC — "Alibaba answers Meta's AI challenge with new laptop-ready model" (17 أغسطس 2026؛ إحصائية 151,448 مشتقاً على HF)
- Artificial Analysis — إدراج Qwen3.8-27B، مؤشر الذكاء 52
- Hacker News — موضوع مراجعة Willison (798 نقطة)
- eigent.ai — ملخص الأوزان المفتوحة لـ Qwen3.8-Max (الأسعار $2/$6/$0.25 وفقاً لـ latent.space)
- codersera — دليل أجيال Qwen (نموذج 27B بترخيص Apache 2.0، يحل محل Qwen3.6-27B؛ تنبيه ترخيص 2.4T)
- kie.ai — تحليل إطلاق 27B (ادعاء Alibaba بأنه "يتفوق على Qwen3.7-Plus"، مواصفات بطاقة HF)
- Beijing Business Today / East Money — "大模型一周三更" (16 أغسطس؛ إحصائية أفضل 10 على OpenRouter)
الأسئلة الشائعة (2026)
هل الأوزان مفتوحة حقاً؟
نعم — يتوفر 2.4T-A95B (+FP8) ونموذج 27B على منظمة Qwen على HF. نموذج 27B مرخص بـ Apache 2.0؛ في حين يُذكر أن 2.4T يحمل شروط ترخيص Qwen الخاصة به، لذا تحقق من البطاقة قبل الاستضافة الذاتية التجارية.
هل يمكنني تشغيل 2.4T بنفسي؟
ليس على عتاد محطات العمل — حيث يبلغ حجم نقطة فحص FP8 نحو 2.5TB وفقاً لأدلة المجتمع. إنه مخصص لمنصات الاستدلال؛ بينما يستخدم الآخرون واجهة API المستضافة أو نموذج 27B.
ما هو العتاد اللازم لنموذج 27B؟
ملف GGUF بتنسيق Q4_K_M بحجم 17GB؛ استخدم Willison جهاز MacBook Pro بذاكرة 128GB (M5 Max) وجهاز DGX Spark بسرعة 15–30 tok/s، مع زيادة بنسبة +72% باستخدام draft-mtp. ارفع القيمة الافتراضية للسياق — حيث يُستهلك 8,192 في التفكير وحده.
هل يدعم إدخال الصور والفيديو؟
نعم — توضح بطاقة 27B الرسمية فهماً بصرياً لغوياً أصلياً للصور ومقاطع الفيديو، بالإضافة إلى تحكم مرن في التفكير. وهو أمر نادر في هذه الفئة الحجمية.
كم تبلغ تكلفة API؟
تشير تغطيات الإطلاق باستمرار إلى أسعار $2 / $6 / $0.25 لكل 1M رمز (مدخلات / مخرجات / مخزنة مؤقتاً) لنموذج qwen3.8-max على Qwen Cloud. تحقق من صفحة Model Studio المباشرة قبل وضع الميزانية.
متى يتوفر 27B المستضاف؟
"قريباً" وفقاً للبطاقة الرسمية — سياق افتراضي 1M بالإضافة إلى أدوات مدمجة. لا يوجد تاريخ أو سعر حتى 21 أغسطس 2026.
ما سبب الشكاوى من الإفراط في التفكير؟
مستوى التفكير xhigh هو الافتراضي: 22,276 رمز تفكير و21 دقيقة لرسم SVG واحد. حل Willison: ابدأ بمستوى تفكير low أو بدون تفكير، وقم بالزيادة فقط عند الحاجة.
مقارنة بـ Kimi K3 / GLM-5.3؟
أتاح K3 أوزان 2.8T (بترخيص معدل) في 27 يوليو؛ وQwen3.8 هو الأول بنقطة فحص من فئة Max بالإضافة إلى نموذج كثيف شقيق بترخيص Apache؛ ومن المتوقع صدور أوزان GLM-5.3 في ~28 أغسطس. يتم تتبع النماذج الثلاثة في رصد النماذج لدينا.