لم يعد عنق الزجاجة هو النموذج، بل الحالة المفقودة لسير العمل

--- title: لم يعد عنق الزجاجة هو النموذج، بل الحالة المفقودة لسير العمل slug: the-bottleneck-is-no-longer-the-model-but-the-missing-workflow-state meta_title: لماذا يحتاج الوكلاء طويلو الأفق إلى حالة سير العمل meta_description: جمعت Zeroset 5.2 مليون دولار لـ Nebula، وهي طبقة حالة تتيح للوكلاء الاستعلام عن كيفية توجيه الشركة فعليًا للموافقات وعمليات التسليم. category: ai tags: Zeroset,Nebula,ذاكرة الوكيل,حالة سير العمل,Gradient Ventures,وكلاء طويلو الأفق,الذكاء الاصطناعي المؤسسي,تنقيب العمليات,LongMemEval,السياق ---
جولة تمويل أولي بقيمة 5.2 مليون دولار ليست رقمًا كبيرًا. لكن الادعاء المرتبط بجولة Zeroset يستحق انتباهًا أكبر من الشيك نفسه: فالعائق أمام وكلاء المؤسسات ليس قدرة النموذج، بل غياب نظام للحالة.
ترك أكشات كانان جامعة ستانفورد في سن 18. وترك ويليام تشانغ جامعة تكساس في سن 21. أسّسا Zeroset في يناير 2026 حول ملاحظة ضيقة. النماذج الرائدة تتعامل بالفعل مع مسودات البريد الإلكتروني والبحث عن الرحلات. لكنها تتعثر عندما تتطلب المهمة معرفة كيف توجّه شركة معينة الموافقات والاستثناءات وعمليات التسليم.
في 6 أكتوبر، قادت Gradient Ventures و2048 Ventures بالاشتراك جولة تمويل أولي بقيمة 5.2 مليون دولار، بمشاركة Leblon Capital. الشركة لديها خمسة أشخاص، ولا يزال الوصول إليها عبر معاينة بحثية مغلقة.
ما الذي تخزّنه Nebula
تتصل Nebula بالأنظمة التي يستخدمها سير العمل بالفعل: Microsoft 365، وSharePoint، وOutlook، وTeams، وGitHub، ومراسلة أماكن العمل. وهي لا تتعامل مع كل مستند كمتجه معزول. بل تبني رسمًا بيانيًا متجهيًا هرميًا بثلاث طبقات: حقائق دلالية، وعناقيد أحداث ظرفية، وعادات إجرائية.

الفرق عن مخزن الذاكرة هو ما يستعيده الوكيل. فبدلًا من إعادة بناء التاريخ، يستعلم عن الحالة الحالية لسير العمل. وتصف الشركة الناتج بأنه حالة محددة النوع وقابلة للاستعلام مع تتبع المصدر: ما هو صحيح، ومتى أصبح صحيحًا، ولماذا يعتقد النظام ذلك.
الاختبارات المرجعية مبكرة لكنها محددة. في LongMemEval، حققت Nebula دقة أعلى بنسبة 20 في المئة من Mem0 وSupermemory وRAG البسيط، عند وسيط أقل من 50 مللي ثانية ومع رموز أقل لكل استعلام. وفي مجموعات بيانات تنقيب العمليات BPI Challenge، تجاوزت جميع الخطوط الأساسية المسجلة في التنبؤ بالنشاط التالي بأكثر من 10 في المئة، وهو اختبار أصعب من الاسترجاع لأنه يسأل عما إذا كان النظام يستطيع توقع الخطوة المشروعة التالية.
عدد الرموز مهم بقدر الدقة. رموز أقل لكل استعلام تعني أن نافذة سياق أصغر يمكنها حمل المعلومات نفسها، ما يخفض التكلفة في كل دورة للوكيل. وبالنسبة لسير عمل يستمر لأسبوع، يتراكم هذا الفرق بالطريقة نفسها التي تتراكم بها الأخطاء.
ملاحظة المؤسسين الأولية هي أكثر صياغة دقيقة للمشكلة. النماذج الرائدة تتعامل مع مسودات البريد الإلكتروني والبحث عن الرحلات. لكنها تتعثر عندما تتطلب المهمة معرفة كيف توجّه شركة معينة الموافقات والاستثناءات وعمليات التسليم. لا شيء خطأ في النموذج في هذا السيناريو. فالمعلومة ببساطة ليست في الموجّه ولا يمكن استرجاعها من مجموعة نصوص عامة.
سطح التكامل هو الخندق الحقيقي
الاتصال بـ Microsoft 365 وSharePoint وOutlook وTeams وGitHub ومراسلة أماكن العمل عمل غير براق، وهو أيضًا الجزء الأصعب في نسخه. يمكن لمنافس أن ينسخ تصميم رسم بياني بثلاث طبقات في ربع سنة. أما إعادة إنتاج موصلات تراعي الصلاحيات وتحافظ على اتساق طبقة الحالة مع ما يُسمح لكل مستخدم برؤيته، فيستغرق وقتًا أطول بكثير، والمشترون في المؤسسات يقيّمون ذلك أولًا.
الصلاحيات هي الجزء الذي تتعامل معه معظم منتجات الذاكرة بشكل سيئ. يجب أن تحترم طبقة حالة سير العمل نفس حدود الوصول التي تفرضها الأنظمة الأساسية، بحيث لا يستطيع وكيل يعمل لصالح مستخدم واحد إظهار حقيقة لا تصبح مرئية إلا على مستوى آخر من المؤسسة. والخطأ في ذلك لا ينتج إجابة خاطئة بقدر ما ينتج حادث امتثال.
وهذا يفسر أيضًا لماذا تدير الشركة معاينة بحثية مغلقة بدلًا من منتج ذاتي الخدمة. فطبقات الحالة لا تكون جيدة إلا بقدر جودة سير العمل الذي رأته، وكل تكامل جديد مع عميل يُظهر حالات حافة في منطق التوجيه لا يغطيها أي اختبار مرجعي.
ما الذي ينبغي للمشترين سؤاله قبل التبني
ثلاثة أسئلة تفصل طبقة الحالة المفيدة عن العرض التوضيحي. هل يسجل النظام متى أصبحت كل حقيقة صحيحة، وهل يمكنه إبطال حقيقة استُبدلت؟ هل يمكنه تفسير سبب اعتقاده بشيء ما، بالرجوع إلى الحدث المصدر؟ هل يفرض الصلاحيات نفسها التي تفرضها الأنظمة التي يقرأ منها؟
متطلب التتبع هو الذي غالبًا ما يُجاب عنه بشكل غامض. فطبقة الحالة التي تُعيد حقيقة دون مصدر هي عمليًا ذاكرة مؤقتة، وذاكرة مؤقتة قديمة داخل وكيل مستقل أسوأ من عدم وجود ذاكرة على الإطلاق، لأن الوكيل سيتصرف بناءً عليها بثقة.
الاستمرارية هي سؤال من الدرجة الثانية. الحالة المستمرة عبر أيام أو أسابيع هي جوهر القيمة المقترحة، وتخزين كل هذه المعرفة التنظيمية المشتقة يثير حديثًا حول حوكمة البيانات بشأن الاستبقاء والحذف والإقامة الإقليمية.
لماذا تتراكم الحالة القديمة
نمط الفشل الذي تسميه الشركة هو سبب وجود هذه الفئة. فحقيقة قديمة أو تعليمات متناقضة لا تسبب خطأً واحدًا. بل تصبح حالة البداية للدورة التالية، ما ينتج إعادة عمل متراكمة، واستدعاءات أدوات إضافية، وتدخلًا بشريًا.
التراكم هو ما يجعله مكلفًا. فعل خاطئ واحد يمكن تداركه. أما افتراض خاطئ يستمر عبر عملية من عشرين خطوة فإنه يفسد كل خطوة بعده، وبحلول الوقت الذي يلاحظ فيه أحد ذلك، يجب إعادة العمل من نقطة تحقق سابقة. الوكلاء الذين يعملون دون إشراف لساعات يجعلون الأمر أسوأ، لأنه لا أحد يراقب الانحراف.
أنظمة الذاكرة الحوارية تسترجع مقاطع متشابهة. وإذا كانت الحقيقة المسترجعة عمرها ثلاثة أسابيع وقد تغيّر سير العمل، فإن الوكيل يستنتج انطلاقًا من عالم لم يعد موجودًا، ولا شيء في الاستجابة ينبّه إلى هذا التعارض. تشابه الاسترجاع وحداثة الحقيقة خاصيتان مختلفتان، ومخزن المتجهات يحسّن الأولى.
رسم Nebula البياني بثلاث طبقات محاولة لمنح الوكيل طريقة للتمييز بينهما. الحقائق الدلالية تصف ما هو صحيح. وعناقيد الأحداث الظرفية تصف ما حدث. والعادات الإجرائية تصف كيف تفعل المؤسسة الأشياء عادةً. أما التتبع فهو الجزء الذي يجعله قابلًا للتدقيق: الحقيقة، ومتى أصبحت صحيحة، ولماذا يعتقد النظام ذلك.
أين يندرج هذا
تشغل Mem0 وZep فئة البنية التحتية للذاكرة المجاورة. ورهان Zeroset هو أن وكلاء المؤسسات طويلي الأفق يحتاجون إلى حالة العملية بدلًا من الذاكرة الحوارية، والتمييز مهم لأي شيء يمتد لأيام أو أسابيع عبر حدود الأنظمة: معالجة المطالبات، وموافقات الإصدار، والمشتريات متعددة الخطوات.
تتشارك هذه العمليات بنية واحدة. فهي تتضمن عمليات تسليم بين الأشخاص والأنظمة، واستثناءات تتبع قواعد غير مكتوبة، وموافقات تعتمد على من هو متاح. لا شيء من ذلك يعيش في مستند. بل يعيش في الممارسة، ولهذا كان تمثيله صعبًا.
تنقيب العمليات هو أقرب سابقة تقنية، ومن الدال أن Zeroset تقيس أداءها مقابل مجموعات بيانات تنقيب العمليات. قضى ذلك المجال عقدين في إعادة بناء كيفية تدفق العمل فعليًا من سجلات الأحداث. وفعل الشيء نفسه في الوقت الفعلي، بحيث يستطيع الوكيل الاستعلام عنه أثناء المهمة، تطوّر معقول.
أطروحة Gradient المنشورة تقول الحجة نفسها. نجح وكلاء المستهلك لأنهم تدربوا على الويب العام. أما وكلاء المؤسسات فلا يزالون يفتقرون إلى تمثيل لكيفية تحرك العمل فعليًا داخل مؤسسة خاصة.
ما الذي يتغير إذا نجح الأمر
شيئان. تتوقف أُطر تشغيل الوكلاء عن إطلاق نوافذ سياق أكبر وأكبر لتعويض البنية المفقودة، لأن المشكلة لم تكن أبدًا حجم النافذة. وتستطيع المؤسسات الاحتفاظ بنموذج التشغيل الخاص بسير عملها داخل حدودها، بدلًا من الأمل في أن يستنتجه نموذج عام في النهاية.
النتيجة الثانية هي الأكثر استراتيجية. فتمثيل سير العمل الذي يعيش داخل حدود الشركة أصل تملكه الشركة. أما تمثيل يستنتجه نموذج عام فهو قدرة تستأجرها. وبالنسبة للصناعات الخاضعة للتنظيم، يحدد هذا الفرق ما إذا كان يمكن نشر وكيل أصلًا.
هناك خطر تنافسي يستحق الذكر. إذا قرر بائع منصة كبير أن حالة العملية تنتمي إلى مجموعته، فإن شركة ناشئة من خمسة أشخاص تواجه مشكلة توزيع بغض النظر عن مدى جودة طبقة الحالة. مشاركة Gradient تساعد، لكن التوزيع ليس شيئًا تحله جولة بقيمة 5.2 مليون دولار.
الأرقام اليوم صغيرة: خمسة أشخاص، واختباران مرجعيان عامان، ومعاينة مغلقة. أما الادعاء فأكبر، وهو قابل للاختبار. وإذا كانت أتمتة المؤسسات قد تجاوزت مرحلة القدرة، فإن الجولة التالية من المنافسة تدور حول من يعرف ما هو العمل فعليًا.
مقالات ذات صلة
صور الأقمار الصناعية أصبحت الآن بيانات تدريب للروبوتات
لم يعد عنق الزجاجة في تدريب الذكاء الاصطناعي الفيزيائي القدرة الحاسوبية ولا قدرة النموذج، بل أصبح جودة العالم الاصطناعي.
Gemini 3.5 Live Translate من Google يلغي التوقف
الترجمة التي تعمل باستمرار، بصوت المتحدث نفسه، على هاتف موجود أصلًا في جيبك، تنقل الميزة من شيء تفتحه إلى شيء يعمل فقط.
الصين تضع أول معيار سلامة إلزامي لوكلاء الذكاء الاصطناعي
تنتقل السلامة من ميزة تروّج لها إلى بوابة تعبر منها. وجرد المخاطر يضم 13 فئة و97 بنداً.
المحتوى المولّد بالذكاء الاصطناعي يبدأ في إعلان هويته
هذه الخطوة لا تحل كل المشكلات، لكنها تحوّل «مولّد بالذكاء الاصطناعي» من خيار يمكن إخفاؤه إلى سؤال يجب الإجابة عنه.