← العودة إلى المدونة
Aiحوالي 1 دقيقة قراءة

GLM-5.2 من Zhipu يصبح مفتوحًا بالكامل: 744 مليار معامل، مدرب على شرائح محلية

نُشر في 7 أكتوبر 2026
GLM-5.2 من Zhipu يصبح مفتوحًا بالكامل: 744 مليار معامل، مدرب على شرائح محلية

أطلقت Zhipu AI، مختبر بكين المعروف أيضًا باسم Z.AI، نموذج GLM-5.2 ووزّعت الأوزان المفتوحة الكاملة خلال أيام. يحمل النموذج 744 مليار معامل إجمالي، مع حوالي 40 مليار معامل نشط لكل رمز، باستخدام معمارية مزيج الخبراء مع تحسين مميز للانتباه المتناثر يُسمى IndexShare.

الرخصة هي MIT. هذا هو العنوان الرئيسي لأي شخص يخطط للبناء عليه: لا استثناءات إقليمية، ولا شروط إيرادات، ولا حد للاستخدام الشهري النشط. النشر التجاري والتعديل وإعادة التوزيع لا تتطلب إذنًا إضافيًا.

ما الذي يمنحك إياه IndexShare

تعيد معمارية IndexShare استخدام مفهرسات الانتباه المتناثر عبر الطبقات، وهو ما تقدّره الكتابات التقنية بانخفاض 2.9x في الحوسبة لكل رمز عند نافذة السياق الكاملة للنموذج البالغة مليون رمز. هذا الرقم يهم أقل كمعيار منعزل وأكثر كحقيقة اقتصادية. جلسات الوكيل ذات السياق الطويل هي حيث تتراكم تكاليف الرموز، وانخفاض 2.9x عند أعلى نافذة السياق يغيّر أعباء العمل القابلة للتطبيق على عنقود معين.

يدعم GLM-5.2 مليون رمز أصلاً، ويُسجَّل كأفضل نموذج مفتوح الأوزان على مؤشر Artificial Analysis Intelligence. في SWE-bench Pro سجل 62.1 في المائة، متقدمًا على 58.6 في المائة لـ GPT-5.5. وفي Terminal-Bench 2.1 حقق 81.0، أقوى نتيجة مُبلَّغ عنها لأي نموذج مفتوح الأوزان.

قصة العتاد هي القصة الجيوسياسية

الجزء من GLM-5.2 الذي سيبقى بعد ضجيج المعايير هو أين يعمل. تم تدريب سلسلة GLM-5 بأكملها على شرائح Huawei Ascend باستخدام إطار MindSpore. هذا ادعاء لا يستطيع أي مختبر غربي تقديمه، وهو السبب وراء جذب النموذج لاهتمام المشترين الذين يفكرون في مرونة سلسلة التوريد بدلاً من الدرجات الخام.

تضيف مواد إصدار Zhipu أن الاستدلال عبر الإنترنت يعمل عبر منصات حوسبة محلية متعددة، مع توافق من اليوم الأول مع Huawei Ascend وT-Head وMoore Threads وCambricon وKunlun وMuxi وHygon وBiren. وتصف الشركة ذلك بأنه تشغيل مستقر بإنتاجية عالية، وزمن انتقال منخفض، وتزامن كبير على عناقيد الشرائح المحلية.

بالنسبة لمؤسسة خارج الصين، السؤال العملي هو ما إذا كانت الأوزان توفر مسارًا مستضافًا ذاتيًا يزيل تكاليف كل رمز. وبالنسبة لمؤسسة داخل الصين، السؤال أوسع: ما إذا كان يمكن بناء نموذج قادر على المنافسة المتقدمة وتقديمه دون الاعتماد على عتاد لا يمكن شراؤه بشكل موثوق.

كم تبلغ التكلفة، وماذا يغيّر الاستضافة الذاتية

تنفصل مستويات التسعير بوضوح. الوصول المباشر عبر واجهة API يبلغ حوالي 1.40 دولار لكل مليون رمز إدخال و4.40 دولار لكل مليون رمز إخراج، مع إدخال مخزّن مؤقتًا عند 0.26 دولار. عبر OpenRouter، الأسعار حوالي 1.00 دولار و4.00 دولار. اشتراك GLM Coding Plan يتراوح بين 10 و18 دولارًا شهريًا لمستوى موجه للمطورين، وهو غير مخصص لحجم الإنتاج.

الاستضافة الذاتية هي حيث تنقلب الحسابات. النشر في الموقع يحمل تكلفة البنية التحتية وبدون رسوم لكل رمز. بالنسبة لعبء عمل يعالج ملايين الرموز يوميًا، هذا الفرق كبير. المقابل هو عنقود GPU، والصيانة، وأعمال التوسع التي تخفيها واجهة API المُدارة. رخصة MIT تقلل الاحتكاك القانوني فوق الاقتصادي.

مكعب شبكي هندسي مفتوح من قضبان نحاسية رفيعة يستقر على قاعدة خرسانية شاحبة

التكميم هو الرافعة الأخرى. مع أوزان مكمّمة، يُقال إن النموذج يعمل على عتاد بمستوى المستهلك، مما يفتح مسارًا مستضافًا ذاتيًا للتطبيقات الحساسة للخصوصية مثل الوكلاء الذين يتعاملون مع السجلات الطبية أو قواعد الشيفرة الخاصة.

الحاشية الأمنية الجديرة بالقراءة

هناك نتيجة واحدة تستحق الانتباه قبل أن يعتبر أي شخص الأوزان المفتوحة غداءً مجانيًا. أفاد تقييم الفريق الأحمر من Anthropic أن GLM-5.3 يُظهر قدرات سيبرانية ذاتية من فئة Mythos مع ضمانات ضعيفة ضد إساءة استخدام الأوزان المفتوحة. لا يمكن استدعاء الأوزان المفتوحة. بمجرد تنزيلها، يبقى النموذج في حيازة المؤسسة الناشرة إلى أجل غير مسمى.

وهذا يخلق مشكلة نشر محددة. يحتاج نموذج مفتوح الأوزان يعمل داخل إطار وكيل إلى طبقات احتواء يتولاها مزود API مغلق من جانبه. رخصة MIT تزيل الارتباط بالمورد، كما تزيل ضمانات الأمان التي يوفرها المورد. يجب على الفرق التي تنشر GLM-5.2 في حلقة وكيل أن تخصص ميزانية لاحتواء وقت التشغيل، لا أن تعتبره مشكلة شخص آخر.

لماذا يختلف وقع هذا الإصدار

تُطلق نماذج مفتوحة كثيرة كل شهر. لكن GLM-5.2 له وقع مختلف لثلاثة أسباب متراكمة.

الرخصة متسامحة حقًا عند مقياس معاملات يكون ذلك نادرًا فيه. معظم الإصدارات المفتوحة من فئة الحدود تأتي بشرط تجاري، أو حد إقليمي، أو حد لعدد المستخدمين. لا يوجد أي من ذلك في GLM-5.2.

مسار العتاد مستقل عن NVIDIA. بالنسبة للمشترين الذين يعتبرون مخاطر سلسلة التوريد أولوية قصوى، فإن ذلك يغيّر القائمة المختصرة بغض النظر عن ترتيب المعايير.

كما أن كفاءة الحوسبة في السياق الطويل تجعل الجلسات متعددة الخطوات المستمرة مجدية اقتصاديًا على عناقيد أصغر من نموذج مثل Nemotron 3 Ultra من NVIDIA، الذي يحتاج إلى عُقد 8xH100 كحد أدنى موثق.

GLM-5.2 ليس أفضل نموذج في كل مهمة، والتحذير الأمني حقيقي. لكن كإشارة إلى ما يمكن أن يكون عليه الإصدار المفتوح الآن، قادر على المنافسة المتقدمة، برخصة متسامحة، ومبني بدون وحدات GPU مصنعة أمريكيًا، فهو الأوضح في هذه الدورة.

العائلة حول النموذج الرائد

من المفيد رؤية GLM-5.2 كقمة سلم بدلاً من إصدار مستقل. تمتد عائلة GLM من GLM-4.6V-Flash خفيف الوزن عند 9B، الموجه للنشر الطرفي، وصولاً إلى الطراز الرائد 744B. تشمل المتغيرات المتخصصة GLM-5V-Turbo للمهام البصرية متعددة الوسائط وإطار وكيل AutoGLM للتخطيط المعقد متعدد الخطوات.

تنطبق الرخصة المتسامحة عبر ذلك السلم، وهو الجزء المهم للفرق التي تختار حزمة تقنية. يمكن للشركة أن تبني نموذجًا أوليًا على النموذج الطرفي الصغير، وتتوسع إلى الطراز الرائد، وتنتقل بينهما دون إعادة التفاوض على الحقوق في كل خطوة. هذا الاستمرار غير معتاد في النظام البيئي المفتوح، حيث تختلف الرخص غالبًا بين الإصدارات الصغيرة والكبيرة للمختبر.

ماذا يعني ادعاء الكفاءة عمليًا

انخفاض 2.9x في الحوسبة لكل رمز عند السياق الكامل هو نوع من الأرقام الذي يُقرأ كمواصفة حتى تربطه بعبء عمل.

تخيل وكيلاً يستنتج عبر قاعدة شيفرة كبيرة أو مجموعة مستندات طويلة. كل خطوة تعيد قراءة سياق متنامٍ، وتكلفة إعادة القراءة هذه هي ما يجعل الجلسات الطويلة مكلفة. انخفاض يقارب ثلاثة أضعاف عند أعلى نافذة السياق يخفض النقطة التي تتوقف عندها الجلسة الطويلة عن كونها مجدية. تظل الجلسة مكلفة، لكن نقطة التعادل تتحرك.

ولهذا أيضًا يهم مسار التكميم. مع أوزان مكمّمة، يُقال إن النموذج يعمل على عتاد بمستوى المستهلك، مما يحول وكيل السياق الطويل من شيء يحتاج إلى عنقود إلى شيء يمكن لفريق صغير تشغيله محليًا. بالنسبة لتطبيق يتعامل مع بيانات حساسة، مثل السجلات الطبية أو الشيفرة المصدرية الخاصة، فإن التشغيل محليًا هو النشر الوحيد الذي يناسب قيد الامتثال، والتكلفة فائدة ثانوية.

أين يؤثر التحذير الأمني

من السهل تصنيف نتيجة الفريق الأحمر كمشكلة شخص آخر. لكنها ليست كذلك، والسبب بنيوي.

يمكن لمزود API مغلق تحديث نموذج، أو تغيير سياسة، أو قطع حالة إساءة استخدام بعد وقوعها. الإصدار مفتوح الأوزان يزيل تلك الرافعة. الأوزان، بمجرد تنزيلها، تبقى في حيازة المؤسسة الناشرة، ولا يمكن لأي مورد إبطالها. هذا هو بيت القصيد من الأوزان المفتوحة، ولهذا أيضًا يجب أن يبني فريق النشر طبقات الاحتواء بنفسه.

عمليًا، هذا يعني أن وكيلاً يشغّل GLM-5.2 يحتاج إلى نفس انضباط وقت التشغيل الذي يطبقه فريق على أي أداة قوية لديها صلاحية الكتابة: أذونات محددة النطاق، وصندوق رمل للإجراءات غير الموثوقة، وتسجيل ينجو من الأعطال، ومسار تصعيد بشري للقرارات المهمة. لا شيء من ذلك توفره الرخصة، ولا شيء منه يأتي مجانًا مع الأوزان. شروط MIT تزيل الارتباط بالمورد على الجانب القانوني، وبحكم التصميم، تزيل الأمان الذي يوفره المورد على الجانب التشغيلي.

مقالات ذات صلة