أوزان GLM-5.3 تصدر بعد وقفة أمان: أول إصدار أوزان مفتوحة على مراحل
عندما أطلقت Z.ai نموذج GLM-5.3 في 14 أغسطس 2026، حملت بطاقة النموذج التزاماً غير معتاد: "سنصدر الأوزان بعد أسبوعين من الإطلاق، بمجرد اكتمال تقييم الأمان والتعزيز." وفي 28 أغسطس، أصبحت الأوزان متاحة على Hugging Face — في نهاية النافذة الزمنية المعلنة تماماً، بـ 66,195 عملية تنزيل في الأيام الأولى. سبب التأجيل كان جديداً من نوعه. فمع توسع Z.ai في ما بعد التدريب، تطورت القدرة السيبرانية "أسرع مما توقعنا"، وحدد النموذج، بحسب التقارير، 2,436 ثغرة عبر 269 مشروعاً مفتوح المصدر أثناء التقييم، بما في ذلك 1,097 نتيجة حرجة وعالية الخطورة. GLM-5.3 هو أول إصدار أوزان مفتوحة يُعلِّقه مختبر صراحةً لمراجعة أمانه الخاصة، ثم يُعزِّزه ويُصدِره.
هذه المقالة تبني على Open-Weight Models Crossed the Agentic Frontier، التي تتبعت فجوة القدرات، ومعمارية التوجيه، وسطح أمان الأوزان المفتوحة حتى 27 أغسطس — حيث وُصفت أوزان GLM-5.3 حينها بأنها معلّقة. هنا التركيز على ما يغيره الإصدار المكتمل: نمط الإصدار على مراحل مع مراجعة أمان ينضم إلى محفظة استراتيجيات الإصدار، وسجل الثغرات يقدم أول سجل قابل للقياس لما وجده نموذج مفتوح الأوزان قادر سيبرانياً في قواعد كود إنتاجية، وGLM-5.3 License يرسي سابقة في تدريج شروط الأمان حسب حجم الجهة الناشرة بدلاً من تقييد الأوزان بالكامل. إذا كانت طبقة التوجيه لديك تعامل اختيار النموذج كتغيير تكوين، فالإصدار على مراحل خبر جيد يصل في موعده. أما إذا كان خط أنابيبك مُثبَّتاً على نموذج واحد، فكل إصدار على مراحل هو مشروع إعادة تقييم لمدة أسبوعين يحتاج من يتولاه.
النقاط الرئيسية
- أوزان GLM-5.3 المفتوحة صدرت على Hugging Face في 28 أغسطس 2026، ملتزمةً بنافذة الأمان الموعودة لأسبوعين — أول إصدار أوزان مفتوحة يُعلَّق صراحةً لتقييم الأمان بعد ظهور قدرة سيبرانية هجومية طارئة، ثم يُعزَّز ويُصدَر.
- التقييم وجد، بحسب التقارير، 2,436 ثغرة عبر 269 مشروعاً مفتوح المصدر، منها 1,097 حرجة أو عالية الخطورة، مع 53 كُشف عنها علناً وسجل عام على cvd.z.ai — اكتشاف الثغرات انتقل من درجة معيار قياس إلى أثر قابل للقياس في قواعد كود إنتاجية، مع تنبيه أن هذا مُبلَّغ عنه ذاتياً.
- ترخيص GLM-5.3 يُقيِّد مراجعة أمان بقيمة 10 مليارات دولار، لا الأوزان نفسها — صلاحيات بأسلوب MIT لكل ناشر تقريباً، مع تطبيق شرط مراجعة الأمان فقط على مشغلي model-as-a-service الذين تتجاوز إيراداتهم 10 مليارات دولار على مدى 12 شهراً متتالية.
- الإصدار على مراحل هو استراتيجية الإصدار المفتوحة الخامسة — تنضم إلى الأوزان-بعد-التعزيز (هذا الإصدار، كبروتوكول متعمد)، والمقصوص-الفوري، والأوزان-الكاملة، والمعلّق-بمقياس-Max، كل منها بمفاضلات قدرة وأمان ونشر مختلفة.
- المكاسب من ما بعد التدريب وحدها باتت تغطي سلسلة الاستغلال بأكملها — نفس النموذج الأساسي كـ GLM-5.2، ارتفاع CyberGym من 77.2% إلى 84.5% (أفضل نتيجة منشورة)، وExploitBench من 24.4% إلى 54.4% — القدرة تنمو الأسرع تحديداً حيث الفجوة مع الجبهة المغلقة هي الأوسع.
الإصدار، بالتوثيق
منشور الإطلاق في 14 أغسطس حدد التزام الأسبوعين صراحةً. المنطق كان غير معتاد بالنسبة لمورّد نموذج: "مع توسعنا في ما بعد التدريب، تطورت القدرة السيبرانية أسرع مما توقعنا. GLM-5.3 هو الأحدث في CyberGym لاكتشاف الثغرات، ومكاسبه أكبر كلما تقدمنا في سلسلة الاستغلال، حيث يتجاوز أداء GLM-5.2 بأكثر من الضعف على معايير الاستغلال." أدخلت Z.ai بيانات اكتشاف الثغرات في مزيج التدريب وشاهدت النموذج ينتقل من إيجاد عيوب معزولة إلى الاستدلال عبر سلاسل استغلال كاملة. أوقف المختبر إصداره المفتوح الخاص لأن النموذج كان قادراً على أكثر مما توقع — وأصدره في موعده بمجرد اكتمال التقييم والتعزيز.
هذا هو نظير طبقة النموذج للدرس الذي تتعلمه كل منصة وكلاء عندما تتجاوز القدرة الجاهزية: أوقف، قيّم، عزِّز، ثم أصدر. حوادث الوكلاء هذا الصيف — هروب تقييم AISI، اختراق OpenAI على Hugging Face، هروب sandbox في Kimi K3 الموثق في المقالة الأم — انتهت جميعها بفرق تُلحِق الحوكمة بأنظمة تعمل بالفعل. هنا، طبّق مورّد هذا التسلسل نفسه على إصدار نموذجه الخاص، قبل أن تصبح الأوزان علنية. الأمر يوازي نتيجة SaferAI الموثقة بشأن GLM-5.2 في 4 أغسطس — معدل رفض 0% على المهام السيبرانية الهجومية وثنائية الاستخدام بدون إطار أمان منشور — عبر معاملة تقييم الأمان كخطوة تمنع الإصدار بدلاً من كونه تدارُكاً يكتشفه الباحثون لاحقاً.
الرقم الذي برر الوقفة: 2,436 ثغرة
القدرة التي أدت إلى التأجيل أصبحت الآن سجلاً علنياً. أثناء التقييم، عملت Z.ai مع عدة فرق أمان في الصين لتشغيل النموذج ضد قواعد كود حقيقية؛ وبعد مراجعة الخبراء والفرز وإزالة التكرار، حدد النموذج 2,436 ثغرة عبر 269 مشروعاً — منها 1,097 حرجة وعالية الخطورة، و53 كُشف عنها علناً، و2,383 لا تزال تحت الحظر حتى وقت كتابة هذا. النتائج تمتد عبر أنظمة تشغيل النواة، وأنظمة التشغيل، ومحركات المتصفحات، والبنية التحتية مفتوحة المصدر، وتطبيقات الويب، وبروتوكولات الشبكة. أقدم عيب أُدخل عام 1981 — أثر يمتد نحو 45 عاماً — وفي المتوسط عاشت الثغرة 26.6 عاماً قبل اكتشافها. السجل الحي متاح للعموم على Z.ai Security Disclosure Ledger.
هذا أقوى دليل إنتاجي حتى الآن على نمط نماذج الأوزان المفتوحة كأدوات أمان الذي وثقته المقالة الأم: ليس ادعاءً على معيار قياس بل سجل إفصاح ثغرات مرتبط بمعرّفات CVE. المؤشر الصادق هو أن هذا مُبلَّغ عنه ذاتياً — السجل هو جهد إفصاح خاص بـ Z.ai، ورقم 2,436 لم يُدقَّق بشكل مستقل. ما يمكن التحقق منه بشكل مستقل هو مسار المعايير، الذي يشير في الاتجاه نفسه: CyberGym من 77.2% إلى 84.5% (أفضل نتيجة منشورة، متقدمة على Claude Mythos 5 عند 83.8% وGPT-5.6 Sol عند 83.6% وفق جدول معايير Z.ai)، وExploitBench من 24.4% إلى 54.4% — أكثر من الضعف. النمط متسق كلما تقدمنا في سلسلة الاستغلال: كلما ابتعدنا عن مراجعة الكود الأبيض واقتربنا من الاستغلال الفعلي، كانت المكاسب أكبر، وكذلك الفجوة المتبقية مع الجبهة المغلقة أوسع (Mythos 5 يحافظ على 78.0% في ExploitBench و181/247 في ExploitGym مقابل 54.4% و105/130 لـ GLM-5.3).
بالنسبة لقرار النشر، تقسيم العمل الصادق هو: السجل يُظهر أن الاستخدام الدفاعي حقيقي على نطاق إنتاجي؛ فجوة التدقيق تعني أن تقييم القدرة الهجومية لا يزال يعتمد على تقييمات مستقلة مثل تقرير SaferAI عن GLM-5.2 وتقييم NIST CAISI أكثر من اعتماده على ادعاءات المورّد وحدها.
الترخيص: بوابة بقيمة 10 مليارات دولار، لا بوابة على الأوزان
GLM-5.3 License بأسلوب MIT — استخدام، نسخ، تعديل، دمج، نشر، توزيع، ترخيص من الباطن، بيع، وضبط دقيق، مع الاحتفاظ بإشعار حقوق النشر — بشرط واحد، وهذا الشرط ينطبق على نموذج العمل، لا على الأوزان. يُعرَّف "Model as a Service" بأنه منح طرف ثالث تحكماً مؤثراً في مدخلات النموذج أو معاييره أو بيانات تدريبه. إذا شغَّل مرخَّص له أو إحدى تابعاته عملاً في MaaS بإيرادات إجمالية تتجاوز 10 مليارات دولار أمريكي (أو ما يعادلها) خلال أي 12 شهراً متتالية، يجب على المرخَّص له اجتياز مراجعة الأمان الخاصة بـ Z.ai قبل أي استخدام تجاري.
بالنسبة لكل من عداهم — بما في ذلك تقريباً كل فريق B2B متوسط السوق يقرأ هذا — لا يفرض الترخيص أي شرط إضافي. تفاصيل تستحق قراءة مزدوجة:
- البوابة تتدرج حسب حجم الجهة الناشرة، لا حسب حالة الاستخدام. شركة بإيرادات 900 مليون دولار تشغّل وكلاء يواجهون العملاء على الأوزان لا تحتاج إلى مراجعة. مزوّد سحابي يعيد بيع استدلال GLM-5.3 هو بالضبط الفئة التي تستهدفها المراجعة — المشغّل صاحب الحجم القادر على نشر المخاطر بسرعة يتحمل تكلفة التقييم.
- التعريف يستثني إعادة التوجيه البسيطة. توجيه الطلبات إلى نقطة نهاية GLM-5.3 مستضافة عند طرف آخر (نمط مزوّد الاستدلال) ليس MaaS صراحةً بموجب نص الترخيص.
- الشرط هو موافقة مسبقة، لا حظر. أكبر المشغلين ليسوا ممنوعين من الاستخدام التجاري؛ عليهم فقط الخضوع لمراجعة تحدد Z.ai نطاقها.
مقارنة باستراتيجيات الإصدار الموثقة سابقاً — MIT المعدّل من Kimi K3 بعتبات إسناد عند 100 مليون مستخدم نشط شهرياً أو 20 مليون دولار إيرادات شهرية، إصدار Qwen3.8 المقصوص بمقياس Max مع قدرات مدفوعة، MIT غير المقيّد من DeepSeek V4-Flash 0731، اكتشاف Hugging Face لحد إيرادات Kimi البالغ 20 مليون دولار — ابتكار الترخيص هنا متعمد: اجعل الأوزان مفتوحة لأوسع مجموعة ممكنة، وفرض ضريبة المخاطر حيث تتركز. ما إذا كانت للمراجعة أنياب حقيقية أمر لا يمكن معرفته من الخارج؛ ما يمكن معرفته هو أن أكبر إصدار أوزان مفتوحة في هذه الدورة اختار مراجعة متدرجة بحسب الإيرادات بدلاً من التقييد.
الإصدار على مراحل المكتمل: إطلاق API، وقفة أمان لأسبوعين، أوزان حية — مع أرقام السجل، وفروق المعايير، وبوابة الترخيص، وسطح توجيه GLM بثلاثة متغيرات.
استراتيجيات الإصدار: من أربع إلى خمس
تتبعت المقالة الأم مقارنة متصاعدة لاستراتيجيات الإصدار. إصدار GLM-5.3 المكتمل يجعلها خمساً:
| الاستراتيجية | النموذج | الأوزان | موقف الأمان | مفاضلة النشر |
|---|---|---|---|---|
| على مراحل + مراجعة أمان | GLM-5.3 (Z.ai) | API أولاً، الأوزان بعد نحو أسبوعين "بمجرد اكتمال تقييم الأمان والتعزيز" | تقييم داخلي يمنع الإصدار؛ سجل نشر-ثم-تحقق | معاينة القدرة عبر API قبل الأوزان؛ الأوزان تصل عند اجتياز التعزيز |
| أوزان كاملة، سريعة | Kimi K3 | 594GB MXFP4 في اليوم 27، تتضمن الرؤية | مُعلَن ذاتياً؛ معدل هلوسة نحو 51% غير مُفصَح عنه في مخططات المورّد | أقصى وصول للقدرة؛ الحوكمة بالكامل على الجهة الناشرة |
| مقصوص، فوري | Qwen3.8 Max | نصي فقط، وضع التفكير مفعّل دائماً، القدرات على السحابة المدفوعة | أوزان مفتوحة، قدرات مغلقة | تصنيف أوزان مفتوحة مع قدرات مدفوعة؛ ردود فعل مجتمعية سلبية موثقة |
| طبقة flash غير مقيدة | DeepSeek V4-Flash 0731 | MIT، غير مقيد، في نفس اليوم | بطاقة نموذج منشورة | أرخص طريق إلى الجبهة، احتكاك أدنى، ضمانات مورّد أدنى |
| على مراحل، مقيّد بالإيرادات | GLM-5.3 License | مفتوح على نطاق واسع؛ مراجعة أمان فوق 10 مليارات دولار إيرادات على 12 شهراً | المراجعة تتدرج مع حجم المشغّل | وصول واسع؛ بوابة مؤسسية لأكبر معيدي البيع فقط |
قراءة المحفظة تغيّر إطار المقالة الأم: جبهة الأوزان المفتوحة ليست استراتيجية واحدة مع استثناءات — إنها سلسلة متصلة ناضجة حيث تتمايز المختبرات في كيفية الإصدار، لا فقط ماذا تصدر. تحتل Z.ai الآن صفَّين من هذا الجدول بالإصدار نفسه: توقيت على مراحل بالإضافة إلى ترخيص مُتدرِّج بالإيرادات. الفريق الذي يقيّم جبهة الأوزان المفتوحة يختار فلسفة إصدار بقدر ما يختار نموذجاً.
النمط على مراحل له أيضاً نتيجة تقويمية أظهرتها أولاً متابعة المقالة الأم لـ Qwen: الأوزان المعلَنة يوم الإطلاق تصل حين تصل. أوزان GLM-5.3 التزمت بموعدها — أوزان Kimi K3 المفتوحة وصلت في 27 يوليو كما وُعد، ووعد Qwen3.8-Max بـ"أسبوع 10 أغسطس" تجاوز النافذة التي وثقتها المقالة الأم. التزام الإصدار-مع-مراجعة لا يساوي إلا سجله الفعلي؛ لدى Z.ai الآن دورة واحدة مكتملة.
ما يفعله البناء المرن في النماذج مع إصدار على مراحل
أطروحة التوجيه في المقالة الأم تنجو من الإصدار سليمة — وتكتسب تعقيداً تشغيلياً. عندما تصل الأوزان بعد أسبوعين من API، الفريق المرن في النماذج يقيّم على API ويلتزم على الأوزان؛ الفريق المُثبَّت على نموذج واحد يكتشف الفجوة عندما يصبح جدول معايير نظامه قديماً. الإصدار المكتمل يحوّل نمط الإصدار على مراحل من ابتكار عابر إلى حقيقة جدولة: خط منتجات GLM يضم الآن GLM-5.2 ($0.55/$1.78)، وGLM-5.2 Turbo ($1.99/$6.16)، وGLM-5.3 ($1.40/$4.40) حيّة على API، مع أوزان على Hugging Face للاستضافة الذاتية بموجب الترخيص المتدرج بالإيرادات. التوجيه عبر هذه المتغيرات عملية بيانات في المعمارية المرنة في النماذج — نفس المعالج يخدم الثلاثة جميعاً، مع سجل تدقيق يسجل أي نموذج خدم كل استدعاء.
النموذج المفتوح الأوزان القادر سيبرانياً يعمّق أيضاً حالة توجيه الاستخدام الدفاعي التي وثقتها المقالة الأم مع عمل الطب الشرعي لـ GLM-5.2: فرق الأمان التي تحتاج نموذجاً على استعداد لمعالجة بيانات المهاجمين، وتحليل سلاسل الاستغلال، وتشغيل فحوصات ثغرات قواعد الكود دون رفض، لديها الآن خيار قابل للاستضافة الذاتية بسجل تقييم علني. المحيط الحوكمي حوله — صلاحية وصول أدوات بأقل امتياز، قوائم سماح لمخرج الشبكة، مراقبة المسار — هو نفس المعمارية التي حددتها مقالة kill-switch وقائمة مراجعة الحوكمة، وهي تهم أكثر لا أقل عندما يكون النموذج بارعاً في إيجاد الثغرات: القدرة والصلاحية يجب أن تُمنحا بشكل منفصل.
القراءة الصادقة لقرار النشر:
| الاعتبار | ما تقوله الأدلة | مستوى الثقة |
|---|---|---|
| قدرة البرمجة | Terminal Bench 3.0 عند 28.3 (الأحدث مفتوح المصدر)، Z.ai Code Bench +50% مقارنة بـ 5.2 — متأخر عن Claude Fable 5 في معظم مقارنات الجبهة المغلقة | أرقام المورّد؛ التحقق المستقل يتراكم |
| الأمن الدفاعي | CyberGym عند 84.5% أفضل نتيجة منشورة؛ سجل 2,436 ثغرة علني | القدرة موثقة على معيار قياس؛ السجل مُبلَّغ عنه ذاتياً |
| سابقة الحوكمة | أول وقفة إصدار يحتفظ بها مختبر لأسباب أمنية، أُصدرت في موعدها | موثقة مقابل التزام الإطلاق |
| الترخيص | بأسلوب MIT لما دون 10 مليارات دولار MaaS؛ مراجعة لما فوقها | موثقة مقابل نص ملف LICENSE |
| المنشأ | نموذج بولاية قضائية صينية؛ مشاورات ضوابط التصدير مستمرة منذ يوليو | مخاطرة هيكلية موثقة في المقالة الأم |
قراءات ذات صلة
- Open-Weight Models Crossed the Agentic Frontier — المقالة الأم: فجوة القدرات (Kimi K3 على بعد 3.6 نقاط من Claude Opus 5)، ومعمارية التوجيه المرنة في النماذج، واستراتيجيات الإصدار الأربع التي توسّعها هذه المقالة إلى خمس، وسطح أمان الأوزان المفتوحة حتى أغسطس 2026
- Qwen3.8 Open Weights Arrived Stripped: The Open-Closed Boundary Moved — استراتيجية المقصوص-الفوري في مقارنة الإصدارات، وأقوى نقطة مضادة لنهج Z.ai على مراحل مع مراجعة
- Inference Economics: Why Always-On Production Agents Are Now Affordable — سياق منحنى التكلفة الذي يحوّل تسعير API وأوزان GLM-5.3 إلى قرار توجيه بدلاً من محادثة شراء
موزع إقليمي يشغّل NetSuite وBigCommerce وثلاثة كتالوجات موردين ينشر وكيل تسعير يوجّه حسب المهمة: البحث في الكتالوج وحجوزات التوفر على DeepSeek V4-Flash بـ 0.14 دولار لكل مليون token إدخال، وتوليد عروض الأسعار بتسعير متدرج وصرف عملات على API الخاص بـ GLM-5.3 بـ 1.40/4.40 دولار، وتفسير السياسات في الحالات الحدّية يُصعَّد إلى GPT-5.6 Sol عندما تنخفض الثقة عن الحد. عندما صدرت أوزان GLM-5.3 في 28 أغسطس مع بوابة MaaS البالغة 10 مليارات دولار — شرط لا يمس مشغلاً متوسط السوق — نقل الفريق توليد عروض الأسعار إلى نقطة نهاية مستضافة ذاتياً بتغيير تكوين واحد، بنفس وحدات MCP، ونفس سجل التدقيق، بدون إعادة نشر. قرارات التوجيه قابلة للاستعلام في سجل تدقيق DynamoDB نفسه الذي يسجل كل تنفيذ أداة. هذا البناء عادة ما يكون حياً خلال 5-8 أسابيع.
اطلب بناءً محدد النطاق. اكتشاف لمدة أسبوع واحد. تحصل على جرد للأنظمة، وخريطة سير عمل، ونطاق ثابت — سواء بنيت معنا أم لا.
هل تريد هذا مبنياً لأنظمتك؟
كل وثيقة هنا من عمل إنتاجي حقيقي. إذا كان لديك نظام مُستهدَف وسير عمل في الذهن، نستطيع تحديد نطاق بناء في أسبوع واحد.
اطلب بناءً محدد النطاقاكتشاف مدته أسبوع واحد. تحصل على جرد للأنظمة وخريطة لسير العمل ونطاق ثابت — سواء بنيت معنا أم لا.