← العودة إلى المدونة
Aiحوالي 1 دقيقة قراءة

كلاودفلير تطلق نموذج قرارات بحجم 27 مليار معامل يتفوق على Jev في وظيفته

نُشر في 6 أكتوبر 2026
كلاودفلير تطلق نموذج قرارات بحجم 27 مليار معامل يتفوق على Jev في وظيفته

أطلقت Cloudflare نموذج Clef في الأيام الأولى من أكتوبر بموجب ترخيص Apache 2.0. وهو نموذج بـ27 مليار معامل مبني على Qwen3.8-27B، ولا يكتب نصوصًا نثرية، بل يمنح درجات للخيارات.

الفئة صغيرة ومحددة. يأخذ نموذج القرار مدخلًا ومجموعة من خيارات المخطط المرشحة، ثم يعيد ترتيبًا بدلًا من جملة مولّدة. أسّس Jev من Typesafe AI هذا النهج وأصبح النقطة المرجعية له. ويأتي Clef كثاني منافس جدي، ووفقًا للأرقام التي نشرتها Cloudflare، فإنه يتفوق على اللاعب الحالي في كل من الدقة وزمن الاستجابة.

كيف تختلف البنية المعمارية

يستخدم Clef تصميمًا قائمًا على التعبئة المسبقة فقط (prefill-only). فهو يقرأ المدخل ويقيّم خيارات المخطط بالتوازي بدلًا من إخراج الرموز واحدًا تلو الآخر. هذا الخيار الواحد يفسر معظم فجوة الأداء، لأن الجزء المكلف في استدعاء نموذج لغوي تقليدي هو حلقة فك التشفير.

على BANKING77، وهو معيار قياسي لتصنيف النوايا، يحقق Clef درجة 94.20 في macro-F1 مقابل 79.74 لـJev. كما تذكر Cloudflare أن Clef-flash، الإعداد الأصغر، لديه زمن استجابة وسيط يبلغ 38.8 مللي ثانية، وتصفه بأنه أسرع بنحو 13 مرة من خط الأساس لـJev البالغ 524.1 مللي ثانية.

الواجهة لا تقل أهمية عن الدرجة. Clef متوافق مع Jev-API، لذا يمكن لفريق مرتبط بالفعل بـJev تبديل نقطة النهاية دون إعادة كتابة كود التكامل. كما يقبل Clef مدخلات متعددة الوسائط ضمن نافذة سياق تبلغ 64,000 رمز، بينما Jev نصي فقط ومحدود بـ32,000.

صياغة Cloudflare مباشرة: بالنسبة للتوجيه والتصنيف والاختيار المنظم، فإن توليد النص عمل مهدور. إذا كانت الإجابة التي تحتاجها هي واحدة من اثنتي عشرة فئة، فإن نموذجًا يكتب فقرة ثم يعالجها لاحقًا يقوم بشيء أصعب مما تتطلبه المهمة.

أين يقع هذا إلى جانب التضمينات

يجدر فصل نماذج القرار عن النهج الأقدم للمشكلة نفسها. ظلّت الفرق توجّه وتصنّف باستخدام التضمينات لسنوات: تضمين المدخل، ومقارنته بأمثلة موسومة، واختيار الأقرب. هذا ينجح، وهو رخيص، لكنه يحتاج إلى مجموعة موسومة للمقارنة بها، ويعاني عندما يعتمد القرار على التعليمات بدلًا من التشابه.

يأخذ نموذج القرار مخططًا ومجموعة خيارات كجزء من الطلب. ويمكنه الإجابة عن نطاق أوسع من الأسئلة مما تسمح به مطابقة التشابه: إلى أي فئة تنتمي رسالة، وأي من ثلاث أدوات يستدعي، وإلى أي نموذج يوجّه، وأي من عدة سياسات ينطبق. تعيش التعليمات في الطلب بدلًا من فهرس أمثلة مُصان، ما يسهّل تغيير السلوك دون إعادة وسم أي شيء.

المقايضة هي أن نموذج القرار لا يزال نموذجًا لغويًا يقوم بالتقييم، لذا يرث أنماط فشله. يمكن أن يكون مخطئًا بثقة عالية، ودرجات ثقته ليست معايَرة إلى احتمال يمكن لسياسة توجيه أن تثق به دون اختبار. يزيل تصميم prefill-only تكلفة فك التشفير، لكنه لا يزيل مشكلة معرفة متى يخمّن النموذج.

حسابات التكلفة هي ما يجعل الفئة مثيرة للاهتمام على أي حال. توجيه طلب عبر نموذج توليدي يكلف عملية توليد كاملة على المسار الحرج، وغالبًا ما يستهلك عدة مئات من المللي ثانية وبضع مئات من الرموز. وتذكر Cloudflare أن Clef يسجل أقل من 40 مللي ثانية وسيطًا لإعداد flash. وبالنسبة لوكيل يتخذ عدة قرارات توجيه في كل دور للمستخدم، يتراكم هذا الفرق، ويتراكم في الخطوة التي يشعر بها المستخدمون فعليًا.

الفئة تتوحّد معاييرها بسرعة

ما يجعل هذا أكثر من مجرد إطلاق بائع واحد هو السرعة التي تكثفت بها الأدوات المحيطة بنماذج القرار.

في 30 سبتمبر، أضاف SGLang مسارات أصلية /v1/decisions و/v1/systemone، ما يتيح لنماذج اللغة والرؤية العمل كمصنفات ومقيّمات دون توليد رمزًا برمز. وأظهر الإطار هذه القدرة عبر تشغيل Qwen3.8-27B كنموذج قرار متعدد الوسائط، وأفاد بأنه تغلب على Pokemon FireRed في محاولة واحدة بزمن استجابة أقل من 100 مللي ثانية.

وبعد أيام، أضاف llama.cpp دعم نماذج القرار عبر نقطة نهاية جديدة /v1/systemone، تشمل نماذج مفتوحة من بينها Kev-4B وOpenJev، مع خطة لإطلاقها في الإصدار 0.6.0. تعمل النماذج الصغيرة على وحدات المعالجة المركزية، وبعضها يدعم مدخلات الصور للتصنيف.

أطلقت Respan منتجها الخاص، Span-01، وهو مصنف استدلال فائق التوازي للكشف عن حقن الأوامر والهلوسة وإساءة استخدام الأدوات في آثار الوكيل. دُرّب باستخدام RLAIF ويقيّم تعريفات سلوك متعددة لم تُرَ من قبل في تمريرة أمامية واحدة. وتسعّره Respan بسنتين لكل مليون رمز إدخال، مع نسخة Lite مجانية.

هذه أربعة مشاريع منفصلة تعامل نماذج القرار كواجهة تستحق التنفيذ الأصلي، خلال أسبوعين. عندما يظهر نمط في إطار استدلال، وبيئة تشغيل محلية، وخط إنتاج شركة ناشئة في الوقت نفسه، فإنه يكف عن كونه مجرد فضول.

لماذا يهم هذا في توجيه الوكلاء

أول المستفيدين هم من يبنون وكلاء يستدعون نماذج أخرى. يحتاج الوكيل إلى تحديد الأداة التي يستخدمها، والنموذج الذي يوجّه إليه، وما إذا كان الطلب محاولة حقن، وما إذا كانت الاستجابة مستندة. اليوم تنفذ فرق كثيرة هذه الخطوات بطلب من نموذج كبير أن يجيب بصيغة JSON مع الأمل في أن يصمد التنسيق.

مصنف يعيد درجة في عشرات المللي ثانية يغيّر تكلفة ذلك القرار. توجيه طلب عبر نموذج لغوي يكلف توليدًا كاملًا، ويكلفه على المسار الحرج. أما توجيهه عبر مقيّم prefill-only فيكلف جزءًا يسيرًا من ذلك وينتهي أسرع. وإذا صمدت الدقة، فإن الأثر العملي هو أن جزءًا أكبر من تدفق تحكم الوكيل يمكن أن يعمل بسرعة الآلة بدلًا من سرعة الرموز.

قضيب زجاجي مصنفر واحد يتوهج بلون فيروزي ويحوم فوق سطح حجري رمادي بسيط

حجة Cloudflare نفسها تتعلق باقتصاديات البنية التحتية. تقول الشركة إن النماذج مفتوحة الأوزان تعمل الآن بتكلفة أقل بنسبة 15 إلى 90 بالمئة من نظيراتها المغلقة لمعظم أعباء العمل الإنتاجية، وإن عصر لحاق الأوزان المفتوحة قد انتهى. ويُقدَّم Clef كدليل: نموذج قابل للتنزيل بترخيص Apache 2.0 يتفوق على منافس خاص في فئة المعيار الخاصة بالمنافس نفسه ويمكن استضافته ذاتيًا.

ما يجب التحقق منه قبل تصديق العنوان الرئيسي

ثمة ثلاثة تحفظات تستحق التمسك بها.

أولًا، معايير القياس مختارة من البائع. BANKING77 مجموعة بيانات نوايا حقيقية وواسعة الاستخدام، لكن رقم macro-F1 واحد لا يصف كيفية تصرف النموذج عبر توزيع إنتاجي بفئات نادرة ومدخلات غامضة وصياغات عدائية. التقييم المستقل سيحسم أكثر مما تستطيع منشورات الإطلاق.

ثانيًا، التوافق مع Jev-API هو ادعاء حول شكل الطلب، وليس حول السلوك. نقطة نهاية بديلة تُرجع معايرة ثقة مختلفة يمكن أن تكسر سياسة توجيه مضبوطة حول الأصل.

ثالثًا، المقارنة تُقاس مقابل Jev كما نُشر. لدى Typesafe AI إصداراتها الخاصة قيد التنفيذ، ونادرًا ما تظل الفجوة بين منافس ولاعب حالي ثابتة طويلًا.

لا شيء من ذلك يزيل النقطة الأكثر رسوخًا. توجد نماذج القرار لأن التوجيه والبوابات والتصنيف تشكل حصة كبيرة مما تفعله بنية الوكلاء فعليًا، وكان تنفيذها باستخدام مولّد نصوص ملاءمة غير مريحة دائمًا. Clef وSpan-01 ونقاط النهاية الجديدة في SGLang وllama.cpp تتقارب على الفكرة نفسها: بعض استدعاءات النماذج يجب أن تعيد رقمًا بدلًا من جملة. والسؤال الآن هو أي من هذه التنفيذات سينتهي تحت حلقة الوكلاء لدى الجميع، وإلى متى ستبقى الفئة متنازعًا عليها.

مقالات ذات صلة