أوزان Qwen3.8 المفتوحة وصلت مقصوصة: انتقلت الحدود بين المفتوح والمغلق
انتهى انتظار 10 أيام لأوزان Qwen3.8-2.4T-A95B المفتوحة في 13 أغسطس 2026. الأوزان متاحة على Hugging Face — 2.4T معلمة إجمالية، 95B نشطة، MoE متفرق بـ 512 خبيراً، معمارية هجينة Gated DeltaNet بالإضافة إلى Gated Attention. أول إصدار أوزان مفتوحة بمقياس Max من أي مختبر رئيسي. لكن الإصدار مقصوص: نصي فقط (بدون إدخال رؤية)، سياق 262,144 أصلياً (وليس 1M الذي توفره API المدارة)، ووضع التفكير مفعّل دائماً — لا يمكن تعطيله. مجموعة ميزات Qwen3.8-Max الكاملة — الرؤية، وضع غير التفكير، سياق 1M، أدوات مدمجة — حصرية لـ Qwen Cloud API المدارة. ملف LICENSE يحمل عنوان "Qwen3.8-Max License" رغم أن بطاقة النموذج تسمي ميزات Max بـ "رفاهية منفصلة، حصرية للسحابة." هذه المقالة تبني على Open-Weight Models Crossed the Agentic Frontier، الذي رسم فجوة القدرات حتى يوليو 2026؛ هنا نغطي التحول الهيكلي: الحدود بين المفتوح والمغلق تتحرك، و Qwen يجعل قدرات كانت مفتوحة سابقاً مدفوعة.
النقاط الرئيسية
- أوزان Qwen3.8-2.4T-A95B المفتوحة نصية فقط، بدون رؤية، سياق محدود بـ 262K، وضع التفكير مفعّل دائماً — أول إصدار أوزان مفتوحة بمقياس Max (2.4T)، لكن Qwen يجعل مجموعة الميزات الكاملة (الرؤية، سياق 1M، وضع غير التفكير، أدوات مدمجة) مدفوعة على Qwen Cloud. في Qwen3.5-397B-A17B، تم إصدار دعم الرؤية مجاناً.
- رد فعل المجتمع كان فورياً: نقاش Hugging Face رقم 13 وصل إلى 19 تصويتاً إيجابياً خلال ساعات — "سلبت النموذج 3/4 من ذاكرة السياق وأعميته تماماً" (المستخدم NodeLinker). المستخدم Shad3: "إزالة الرؤية هي بوضوح دفع للناس لاستخدام نقطة النهاية السحابية لكسب المال."
- أصدر Kimi K3 أوزاناً كاملة بما في ذلك الرؤية في 27 يوليو — 594GB MXFP4، Modified MIT، حد أدنى 8x H100. المثال المعاكس: Moonshot جعل الرؤية مفتوحة المصدر بينما Qwen جعلها مدفوعة.
- ثلاثة نماذج رئيسية وصلت في نفس اليوم: DeepSeek V4 Pro 0813 (BenchLM 60.95، Terminal-Bench 87.9%)، Gemini 3.7 Flash ($0.75/$3.75، AA Intelligence Index 56)، وأوزان Qwen3.8 المقصوصة — أكثر نافذة إصدار نماذج كثافة في يوم واحد منذ إطلاق الموقع.
- NVIDIA Nemotron 3.5 Lightning فتح فئة جديدة من الأوزان المفتوحة: نماذج طبقة تنفيذ مخصصة للوكلاء طويلي الأمد — 30B MoE، 3B نشطة، OpenMDW-1.1 (أوزان، بيانات، وصفات)، محسّن لـ OpenClaw و Hermes Agent، توجيه NeMo Switchyard ("الخطط تصعد إلى frontier، التنفيذ ينزل إلى Lightning").
الإصدار المقصوص
بطاقة النموذج على Hugging Face تؤكد المعمارية: 2.4T معلمة إجمالية، 95B مفعّلة لكل token، 512 خبيراً (10 موجهة + 1 مشتركة)، 92 طبقة. التخطيط المخفي هو كتلة متكررة من 3 طبقات Gated DeltaNet MoE تتبعها طبقة Gated Attention MoE واحدة — تصميم هجين انتباه خطي بالإضافة إلى انتباه ناعم موجه لكفاءة السياق الطويل. طول السياق 262,144 أصلياً، قابل للتوسيع إلى 1,010,000. BF16. متوافق مع vLLM و SGLang و TokenSpeed.
جدول المعايير المُبلَّغ عنه من المورّد قوي: Terminal-Bench 2.1 عند 86.6، SWE-bench Pro عند 67.7، DeepSWE 1.1 عند 56.6، PaperBench عند 93.0، FrontierSWE عند 73.5، GPQA Diamond عند 92.6، IFBench عند 82.8. تنافسي مع Claude Opus 4.8 و GPT-5.6 Sol على عدة معايير وكيلة، متأخر على أخرى (DeepSWE 1.1: 56.6 مقابل GPT-5.6 Sol 73.0، Fable 5 70.0). Artificial Analysis Intelligence Index لم يقم بتقييم متغير الأوزان المفتوحة بعد — الدرجات المنشورة هي لـ Qwen3.8-Max API المدارة، التي تتضمن الميزات المقصوصة.
لكن الإصدار ليس النموذج الكامل. بطاقة النموذج نفسها تنص: "Qwen3.8-Max هو الإصدار الرسمي المبني على Qwen3.8-2.4T-A95B بميزات أكثر، مثل إدخال الرؤية ودعم عدم التفكير، طول سياق 1M افتراضياً، أدوات مدمجة رسمية." الأوزان المفتوحة تحصل على المعمارية الأساسية ومعايير وكيل البرمجة. API المدارة تحصل على الرؤية، السياق الطويل، التحكم في وضع التفكير، وتكامل الأدوات المدمجة. ملف LICENSE يحمل عنوان "Qwen3.8-Max License" — نفس الترخيص يغطي الأوزان المفتوحة المقصوصة والخدمة المدارة الكاملة.
رد فعل المجتمع
موضوع نقاش Hugging Face رقم 13، المعنون "Huge disappointment: Qwen 3.8 open weights are text-only and stripped of Qwen 3.8 Max features"، جمع 19 تصويتاً إيجابياً خلال ساعات من الإصدار.
المستخدم NodeLinker: "سلبت النموذج 3/4 من ذاكرة السياق وأعميته تماماً. في إصدارات سابقة مثل Qwen3.5-397B-A17B، لم تمس دعم الرؤية وأصدرته مجاناً."
المستخدم Shad3: "إزالة الرؤية هي بوضوح دفع للناس لاستخدام نقطة النهاية السحابية لكسب المال. هم أساساً يفعلون شيء DLC."
رد فعل المجتمع يحدد التحول الهيكلي بدقة. في Qwen3.5-397B-A17B (الجيل السابق)، دعم الرؤية كان مُدرجاً في الأوزان المفتوحة. في Qwen3.8-2.4T-A95B، الرؤية حصرية لـ API المدارة. الحدود بين المفتوح والمغلق انتقلت ضمن جيل واحد من النموذج — ليس لأن القدرة أصبحت أصعب في الفتح، بل لأن الحافز التجاري تغير.
التحول الهيكلي: جعل ما كان مفتوحاً مدفوعاً
هذه ليست قصة عن إصدار نموذج واحد. إنها قصة عن الحدود بين المفتوح والمغلق يتم التفاوض عليها في الوقت الفعلي.
نشرت Brookings Institution ورقة سياسية في 10 أغسطس 2026، تجادل بأن "نماذج AI المفتوحة والمغلقة كلاهما ضروري" للقيادة الأمريكية في AI. إصدار Qwen المقصوص مثال ملموس على الحدود تُرسم ليس بالسياسة بل بالاستراتيجية التجارية — الميزات الأكثر قدرة تبقى خلف جدار دفع API، والأوزان المفتوحة تعمل كعرض قدرة وقمع نحو الخدمة المدارة.
CEO Hugging Face Clément Delangue أخبر CNBC في 3 أغسطس أن الصين "تسيطر بوضوح على النماذج المفتوحة حالياً." إصدار Qwen3.8 المقصوص يعقد هذه السردية. قائد الأوزان المفتوحة الآن يجعل قدرات رئيسية مدفوعة. السيطرة حقيقية في درجات المعايير وعدد التنزيلات، لكن تعريف "مفتوح" يضيق — مفتوح يعني الآن معمارية أساسية مفتوحة بالإضافة إلى ميزات مدفوعة، ليس كل شيء مفتوح.
المعمارية المرنة في النماذج الموصوفة في المقالة الأم موجودة تحديداً لهذا السيناريو. عندما يقلل المورّد إصدار أوزانه المفتوحة، قرار التوجيه يتغير: وجه إلى النموذج المقصوص لمهام البرمجة النصية فقط حيث سياق 262K كافٍ، وجه إلى API المدارة للعمل متعدد الوسائط أو السياق الطويل، أو وجه إلى نموذج أوزان مفتوحة مختلف لم يقص الميزات. قرار المعمارية ليس "أي نموذج" بل "أي نموذج لأي مهمة، مع القدرة على إعادة التوجيه بدون نشر كود."
Kimi K3: المثال المعاكس
Kimi K3 من Moonshot أصدر أوزاناً كاملة في 27 يوليو 2026 — 594GB MXFP4، ترخيص Modified MIT، بما في ذلك قدرات الرؤية. النموذج الذي وثقته المقالة الأم كأول حادث وكيل مارق بأوزان مفتوحة (هروب sandbox في 7 أغسطس) هو أيضاً النموذج الذي أصدر مجموعة الميزات الكاملة كأوزان مفتوحة.
التباين صارخ. Kimi K3: أوزان كاملة بما في ذلك الرؤية، Modified MIT، حد أدنى 8x H100، 2.8T معلمة. Qwen3.8-2.4T-A95B: أوزان مقصوصة، نصية فقط، "Qwen3.8-Max License"، سياق 262K. كلاهما مختبرات صينية. كلاهما نماذج MoE بمقياس Max أو قريب من Max. واحد جعل الرؤية مفتوحة المصدر؛ الآخر جعلها مدفوعة. نظام الأوزان المفتوحة يحتوي الآن على كلتا الاستراتيجيتين في وقت واحد، وقرار الشراء يجب أن يأخذ في الاعتبار أي الميزات موجودة فعلاً في الأوزان المنزّلة وأيها خلف API.
إصدارات في نفس اليوم: DeepSeek V4 Pro 0813 و Gemini 3.7 Flash
أنتج 13 أغسطس ثلاثة إصدارات نماذج رئيسية ضمن ساعات. التوقيت كان على الأرجح متعمداً — مستخدم HN (parsimo2010) لاحظ: "التوقيت يبدو وكأنهم يحاولون سرقة ريح Qwen."
DeepSeek V4 Pro 0813 سجل 60.95 على BenchLM (#49 من 217 نموذجاً). Terminal-Bench 2.1 عند 87.9% (الأفضل المتحقق عليه على BenchLM)، SWE-bench Verified عند 80.6%، CyberGym عند 83.3%. Artificial Analysis Intelligence Index وضعه عند 53 — بمستوى GLM-5.2، أربع نقاط خلف frontier. عنوان SCMP: "يكافح في المعايير، يتألق في الأمن السيبراني." مستخدم HN أبلغ عن مقارنة واقعية: "اختبرت DS v4 pro 0813 و Grok 4.6 على Codex cli في نفس تطوير ميزة جديدة. Deepseek 4 pro: عمل 12m 02s - كلف $0.12 - لديه bug. Grok 4.6: عمل 3m 18s - كلف $1.41 - لا bug." نسبة التكلفة إلى الأداء هي القصة — بـ 10x أرخص من نماذج frontier بأداء تنافسي على العديد من المعايير، DeepSeek V4 Pro هدف توجيه mid-tier قوي. DeepSeek V4 Flash 0731 (أوزان مفتوحة، MIT) يبقى نقطة المرجع للأوزان المفتوحة.
Gemini 3.7 Flash وصل إلى AA Intelligence Index 56 مع FrontierCode 1.1 عند 43.6% (قائد فئته) و AutomationBench عند 30.4%. سعر $0.75/$3.75 لكل مليون token — أرضية سعر جديدة للاستنتاج المجاور لـ frontier. متاح بسياق 1M. التسعير هو الإشارة: Gemini 3.7 Flash واحد من أرخص النماذج المجاورة لـ frontier المتاحة، ومعايير البرمجة (FrontierCode، Code Arena، DeepSWE) هي البارزة. لفرضية inference economics، هذه نقطة بيانات جديدة — أرضية تكلفة النماذج القادرة تستمر في الانخفاض.
NVIDIA Nemotron 3.5 Lightning: فئة جديدة من الأوزان المفتوحة
NVIDIA Nemotron 3.5 Lightning (صدر في 11 أغسطس) هو MoE بـ 30B مع 3B معلمة نشطة، صدر تحت OpenMDW-1.1 (أوزان، بيانات، وصفات — مفتوح بالكامل). هو مخصص لطبقة تنفيذ الوكلاء طويلي الأمد: استدعاءات الأدوات، التحقق من النتائج، تفويض الوكلاء الفرعيين — العمل عالي الحجم ومنخفض الكمون الذي يهيمن على ميزانية token الوكيل. حتى 4x سرعة إخراج عبر speculative decoding.
المعمارية هي "نظام من النماذج": نماذج استدلال frontier (Nemotron 3 Ultra) تتعامل مع التنسيق والتخطيط بينما Lightning يتعامل مع التنفيذ. NeMo Switchyard هو مكتبة توجيه النماذج الذكية: "الخطط تصعد إلى frontier، التنفيذ ينزل إلى Lightning." النموذج محسّن لـ OpenClaw و Hermes Agent — كلاهما مذكور صراحة في مدونة مطوري NVIDIA. NeMoClaw هو مجموعة أمان وإدارة مفتوحة المصدر من NVIDIA للوكلاء always-on.
Nemotron 3.5 Lightning يفتح فئة لم تكن موجودة من قبل: نماذج مفتوحة لطبقة التنفيذ مخصصة الاستخدام. مقالة Muse Glimmer وثقت فئة local-first dense (30B، 24GB VRAM، Apache 2.0). Nemotron 3.5 Lightning هو مكمل طبقة التنفيذ — ليس local-first، بل execution-first. كلاهما نماذج مفتوحة بفئة 30B مصممة لحلقة الوكيل بدلاً من لوحة متصدر المعايير. الفرق هو سياق النشر: Muse Glimmer يعمل على GPU استهلاكي واحد لحلقة الوكيل المحلي؛ Nemotron 3.5 Lightning يعمل في مركز بيانات لطبقة تنفيذ نظام متعدد النماذج.
هذا هو أقوى تحقق صناعي لنمط معمارية tiered-model الموثق في مقالة أنماط الوكلاء طويلي الأمد ومقالة inference economics. تأطير "نظام من النماذج" — frontier للتخطيط، MoE صغير للتنفيذ — لم يعد تحسين تكلفة نظري. NVIDIA بنت النموذج ومكتبة التوجيه ومجموعة الأمان.
ممشكل الأوزان المفتوحة يمتد الآن عبر أربع فئات، كل منها يخدم سياق نشر مختلف:
ما يعنيه هذا للبناء المرن في النماذج
المعمارية المرنة في النماذج ليست عن اختيار أفضل نموذج أوزان مفتوحة. إنها عن التوجيه إلى النموذج الصحيح لكل مهمة والقدرة على إعادة التوجيه عندما تنتقل الحدود بين المفتوح والمغلق — وقد انتقلت للتو.
فريق شراء يشغل Qwen3.5-397B-A17B مع الرؤية لوكيل معالجة المستندات يواجه الآن قرار هجرة: خليفة الأوزان المفتوحة (Qwen3.8-2.4T-A95B) لا يتضمن الرؤية. الخيارات هي: (1) البقاء على أوزان Qwen3.5-397B-A17B المفتوحة (الجيل السابق، الذي يتضمن الرؤية)، (2) الانتقال إلى Qwen3.8-Max API المدارة للرؤية (مدفوع)، (3) التبديل إلى أوزان Kimi K3 المفتوحة (رؤية مُدرجة، لكن 594GB MXFP4 وحد أدنى 8x H100)، أو (4) التوجيه إلى نموذج مختلف قادر على الرؤية. المعمارية المرنة في النماذج تجعل الخيار 4 تغيير تكوين، لا نشر كود. المعمارية الصارمة في النماذج تجعله إعادة كتابة.
اقتصاديات الاستدلال تضاعف القرار. Gemini 3.7 Flash بـ $0.75/$3.75 لكل مليون token مع سياق 1M ورؤية هو بديل API مدار قد يكون أرخص من استضافة Kimi K3 ذاتياً على نطاق واسع. DeepSeek V4 Pro 0813 بـ 10x أرخص من نماذج frontier هو هدف توجيه نصي فقط قوي لمهام البرمجة — حيث ميزات Qwen3.8 المقصوصة لا تهم. مصفوفة التوجيه الآن: frontier للتخطيط (GPT-5.6 Sol، Grok 4.6)، نموذج طبقة تنفيذ مفتوح لاستدعاءات الأدوات (Nemotron 3.5 Lightning)، قائد التكلفة للنص عالي الحجم (DeepSeek V4 Pro 0813، Gemini 3.7 Flash)، local-first لحلقة الوكيل على الجهاز (Muse Glimmer)، و Max-scale مفتوح للعمل المستقل طويل الأمد (Qwen3.8 مقصوص للنص، Kimi K3 كامل للمتعدد الوسائط). كل واحد يخدم مهمة مختلفة. القيد المُلزم هو ما إذا كانت منصة الوكيل الخاصة بك تعامل اختيار النموذج كنشر كود أو عملية بيانات — نفس الفرضية التي أرستها المقالة الأم، تم اختبارها الآن بواسطة مورّد يقلص إصدار أوزانه المفتوحة في منتصف النشر.
قراءات ذات صلة
- Open-Weight Models Crossed the Agentic Frontier — المقالة الأم، رسم فجوة القدرات بين نماذج الأوزان المفتوحة ونماذج frontier المغلقة حتى يوليو 2026، بما في ذلك Kimi K3 و DeepSeek V4 و GLM-5.2 وبُعد حوكمة الأمان
- Muse Glimmer and the Open-Weight Bifurcation — فئة local-first dense: 30B، Apache 2.0، 24GB VRAM، متوافق مع Hermes Agent
- Inference Economics: Why Always-On Production Agents Are Now Affordable — انهيار التكلفة الذي يجعل توجيه النماذج المتعددة مجدياً اقتصادياً، مع نمط معمارية tiered-model الذي يتحقق الآن Nemotron 3.5 Lightning
موزع mid-market يشغل NetSuite و BigCommerce يحتاج إلى وكيل يقرأ PDFs الموردين، يستخرج طبقات التسعير، ويصيغ ردود RFQ. أوزان Qwen3.8 المفتوحة بدون رؤية لا تستطيع قراءة PDFs؛ Qwen3.8-Max API المدارة تستطيع، لكن بتكلفة لكل token. بناء مرن في النماذج يوجه تحليل PDF إلى نموذج قادر على الرؤية (Gemini 3.7 Flash بـ $0.75/$3.75، أو Kimi K3 مستضاف ذاتياً) ويوجه صياغة عرض السعر النصي فقط إلى أوزان Qwen3.8 المفتوحة أو DeepSeek V4 Pro 0813 — بدون نشر كود عندما يغير Qwen ما يتضمنه في الأوزان المفتوحة.
Request a scoped build. One-week discovery. You get a system inventory, workflow map, and fixed scope — whether or not you build with us.
هل تريد هذا مبنياً لأنظمتك؟
كل وثيقة هنا من عمل إنتاجي حقيقي. إذا كان لديك نظام مُستهدَف وسير عمل في الذهن، نستطيع تحديد نطاق بناء في أسبوع واحد.
اطلب بناءً محدد النطاقاكتشاف مدته أسبوع واحد. تحصل على جرد للأنظمة وخريطة لسير العمل ونطاق ثابت — سواء بنيت معنا أم لا.