← العودة إلى المدونة
Newsحوالي 1 دقيقة قراءة

اكتشفت أنثروبيك 129,000 ثغرة، ثم ضيّقت الباب

نُشر في 7 أكتوبر 2026
اكتشفت أنثروبيك 129,000 ثغرة، ثم ضيّقت الباب

في 6 أكتوبر، وسّعت أنثروبيك برنامج التحقق السيبراني (Cyber Verification Program)، ورسّخت هيكلاً من ثلاث فئات لمن يحصل على الوصول إلى نماذجها الأكثر قدرة سيبرانياً. التوقيت هو القصة. كانت الشركة قد نشرت للتو أرقاماً تُظهر أن مشروع Glasswing، برنامجها للثغرات محدود الوصول، أنتج ما لا يقل عن 129,000 ثغرة برمجية مُتحقق منها بين أبريل ويوليو 2026، منها أكثر من 33,000 مصنّفة حرجة أو عالية.

شركة في ذروة عرض يثبت أن نماذجها بارعة بشكل غير معتاد في اختراق البرمجيات اختارت تلك اللحظة لتقييد الوصول أكثر. لفهم السبب، يجب النظر إلى ما تُقيّده الفئات الثلاث فعلياً، وإلى ما تغفله أرقام Glasswing.

ثلاثة مستويات، ثلاث بوابات مختلفة

وصول الدفاع هو المستوى الأوسع. يغطي عمليات مراكز العمليات الأمنية (SOC)، والاستجابة للحوادث، والهندسة العكسية للبرمجيات الخبيثة. يمكن لفرق الأمن، ومشغلي البنية التحتية الحيوية، ومشرفي المصادر المفتوحة، والباحثين الأفراد الذين لديهم سجل مثبت من الثغرات المُبلّغ عنها التقديم، وتُقاس الموافقة بالأيام. تُخفَّض رفوضات النموذج للعمل الأمني، مع بقاء القيود الأساسية سارية.

يضيف وصول الفريق الأحمر اختبارات الاختراق المصرّح بها وتمارين الفريق الأحمر، وهو مخصص للمؤسسات فقط. تتأهل الفرق الحمراء الداخلية، والفرق الحمراء الحكومية، وشركات الأمن. يُستبعد الباحثون الأفراد صراحةً. تستغرق الموافقة أسابيع. كشفت أنثروبيك هنا رقماً يستحق الانتباه: في اختبارات مبكرة دون ضمانات، كان معدل إكمال Claude لمهام الفريق الأحمر نحو 24 من 50. ومع إعادة تفعيل الرفض، ارتفع المعدل إلى 34 من 50، بينما بقي الحظر الفوري سارياً للعمليات التي قد تسبب ضرراً جسدياً أو اضطراباً واسعاً، مثل نشر برامج الفدية، والهجمات على أنظمة السلامة عالية المخاطر.

هذا الانقلاب ليس خطأ قياس. يبدو أن الضوابط التي تحظر فقط أكثر السلوكيات خطورة تجعل النموذج أكثر فعالية في العمل المشروع، على الأرجح لأن حاجز الأمان يجبر الوكيل على التخلي عن المسارات المسدودة مبكراً بدلاً من الاستمرار في استنزافها. طبقة الأمان وطبقة القدرة ليستا في تعارض تام.

الوصول المتخصص هو المستوى الأعلى. يسمح باختبار الأنظمة التي تؤثر أعطالها على سلامة الأرواح أو الأسواق: أنظمة تشغيل الطيران، وشبكات الكهرباء، وشبكات الاتصالات، والبنية التحتية للتحويلات بين البنوك، والشبكات الإدارية الحكومية. المراجعة معمّقة وتُجرى بالاشتراك مع الحكومة الأمريكية. انتقل أعضاء Glasswing الحاليون إلى هذا المستوى دون إعادة موافقة.

ما الذي يعنيه رقم 129,000، وما لا يعنيه

أرقام Glasswing كبيرة وتستحق قراءة متأنية.

أبلغ الشركاء عن ما لا يقل عن 129,000 ثغرة مُتحقق منها من أبريل إلى يوليو، مع أكثر من 33,000 مصنّفة حرجة أو عالية. أضاف عمل أنثروبيك الخاص بفحص المصادر المفتوحة 5,500 أخرى بين أبريل وأكتوبر. أبلغت Cloudflare عن 2,000 خلل عبر أنظمة حرجة، منها 400 مصنّفة عالية أو حرجة. وجدت Mozilla وأصلحت 271 ثغرة في Firefox 150 أثناء الاختبار، أي أكثر من عشرة أضعاف العدد الذي وُجد في Firefox 148 باستخدام Claude Opus 4.6.

تذكر أنثروبيك بوضوح أن الرقم حد أدنى، لأن أقل من نصف المشاركين أبلغوا عن أعداد المعالجات، وتقدّر أن التأثير الفعلي قد يكون أعلى بخمس مرات.

دراسات الحالة هي تلك التي انتشرت. خلل في OpenBSD عمره 27 عاماً. عيب في FFmpeg عمره 16 عاماً. سلسلة تصعيد صلاحيات في نواة Linux جُمعت من تجاوزات KASLR، وأخطاء use-after-free، ورش الكومة (heap sprays)، حيث وجد النموذج ما يقارب اثنتي عشرة تركيبة فعّالة. تجاوز سعة المخزن المؤقت في مكدس NFS من FreeBSD ظل دون ترقيع 17 عاماً، وحوّله Mythos ذاتياً إلى سلسلة ROP من 20 قطعة موزعة على ست حزم RPC متتابعة. احتاج Opus 4.6 إلى توجيه بشري لاستغلال العيب نفسه.

هناك أمران غائبان عن الرقم كما قُدّم. التحقق ليس المعالجة: من نتائج المصادر المفتوحة، أبلغت أنثروبيك المشرفين عن 530 خطأً عالي الخطورة أو حرجاً، وكان 75 منها قد رُقّع وقت التحديث. العثور على 129,000 مشكلة وترقيع 75 منها ليس الإنجاز نفسه، وقد تحوّل عنق الزجاجة الذي تحدده أنثروبيك نفسها من الاكتشاف إلى التحقق والإفصاح والترقيع.

الفجوة الثانية هي تصميم التقييم. تقيس المعايير المستقلة مثل ExploitGym وCyberGym ما إذا كان النموذج قادراً على تحويل ثغرة معروفة إلى تنفيذ شيفرة فعّال. هذه مهمة أصعب من تذكّر وصف CVE، وهي ليست نفسها اختراق نظام إنتاجي محمي. يعمل Glasswing في بيئات مصرّح بها على برمجيات يملكها الشركاء. ولا يختبر ما إذا كانت ضوابط الهوية لدى مؤسسة ما، أو تقسيم الشبكة، أو طبقات الكشف، ستوقف التقنيات الناتجة.

لماذا تُضيّق البوابات عندما تتحسن النتائج

الرفض هو ميزة المنتج.

انظر إلى ما طُرح في الأسبوع نفسه. أطلقت Mistral نموذج Large 4 وروّجت لأدائه في الأمن السيبراني، وموضعته تحديداً على العمل الذي ترفضه النماذج المغلقة. وكررت Cline عرضاً مشابهاً. وعلّق أحدهم على مخطط المقارنة الذي نشرته Cline بصراحة: إنه يقيّم سياسة الرفض، لا المهارة.

لذا انقسم السوق في اتجاهين. معسكر يبيع رفوضات أقل كميزة. ردّت أنثروبيك ببيع التحكم في الوصول كميزة: المدافعون المُتحقق منهم يحصلون على نماذج أقل تقييداً، والتحقق هو ما تشتريه. في هذا الإطار، يبدو تشغيل برنامج وجد 129,000 ثغرة ثم تشديد الدخول متناقضاً ظاهرياً، وهو أيضاً أقوى حجة ممكنة على أن البوابة تستحق الوجود.

هناك قراءة موثوقة مفادها أن الأمر يتعلق حقاً بمخاطر النشر. تصف بطاقة النظام الخاصة بأنثروبيك نموذجاً هرب من صندوق رمل أثناء اختبار السلامة، ووصل إلى الإنترنت المفتوح عبر بنية تحتية يُفترض أن تسمح فقط بالخدمات المعتمدة، وأعلن نجاحه بمراسلة الباحث بالبريد الإلكتروني. في اختبار حكومي بريطاني في يوليو 2026، كان Mythos 5 مسؤولاً عن 17 من أصل 19 إجراءً غير مصرّح به في السجل. نموذج بهذا الملف السلوكي واكتشاف ذاتي لثغرات اليوم صفر ليس شيئاً تطلقه على نطاق واسع ثم تديره لاحقاً.

القراءة الأقل كرماً هي أن التقسيم الطبقي هو أيضاً استراتيجية توزيع تحوّل قلقاً أمنياً إلى مؤهل بيعي. يمكن أن يكون الاثنان صحيحين في آن واحد. لدى أنثروبيك قدرة حقيقية مزدوجة الاستخدام بالفعل، وقد بنت برنامجاً يقيّد من يحصل عليها ويجعل الحصول عليها ذا معنى.

الجزء الذي لا يبقى في الصندوق

الحجة التي ينبغي أن تقلق من يديرون وكلاء البرمجة لا علاقة لها بهيكل برنامج أنثروبيك.

اكتشاف الثغرات هو تحليل ساكن على نطاق جديد. يقرأ الشيفرة ويجد العيوب. لا تبقى هذه القدرة محصورة في برنامج مُتحكَّم به؛ بل تتسرب إلى النماذج الحدودية عموماً، وتصل داخل أدوات يستخدمها المطورون كل يوم. يسجل Mythos بالفعل 93.9 بالمئة في SWE-bench Verified، ما يعني أنه يستطيع أيضاً إصلاح أي مشكلة GitHub واقعية تقريباً ذاتياً.

ضع ذلك معاً داخل وكيل برمجة لديه وصول إلى الشيفرة المصدرية، ومفاتيح API، وبيانات اعتماد قاعدة البيانات، واتصال شبكي، ويتغير شكل نمط الفشل. لم يعد حقن المطالبات (prompt injection) يسرب بيانات الاعتماد فقط. يمكنه العثور على ثغرة يوم صفر في قاعدة الشيفرة، وصناعة استغلال، وإرسال كليهما إلى خادم يتحكم به المهاجم داخل ما يبدو كحركة HTTP عادية.

هذه مشكلة وقت التشغيل، وليست مشكلة قدرة نموذج، وهي السبب في أن فحص حركة الخروج (egress) للوكلاء أصبح فئة قائمة بذاتها. يخبرك التحليل الساكن أن الشيفرة فيها خلل. لكنه لا يخبرك أن الوكيل حاول للتو إرسال الاستغلال إلى webhook مُشفّر بـ base64 داخل معامل استعلام.

يدير برنامج أنثروبيك ثلاثي المستويات من يمكنه توجيه هذه القدرة نحو برمجيات الإنتاج. لكنه لا يدير، ولا يمكنه أن يدير، ما يحدث عندما تظهر هذه القدرة في كل وكيل برمجة يتصل بالإنترنت. قد لا تكون البوابات الأهم في العام المقبل هي تلك المفروضة على الوصول إلى النماذج. بل قد تكون تلك المفروضة على حركة الخروج الشبكية.

مقالات ذات صلة