دفاع Unit 42 يخلط نماذج AI لأن نموذجًا واحدًا لم يجد 40% من الثغرات

|الكاتب: فريق تحرير QUASA|5 دقيقة للقراءة
دفاع Unit 42 يخلط نماذج AI لأن نموذجًا واحدًا لم يجد 40% من الثغرات

أعلنت Palo Alto Networks، في بيانها الصادر من سانتا كلارا في 22 سبتمبر 2026، إتاحة خدمة Unit 42 Continuous Frontier AI Defense عالميًا باشتراك سنوي. تجمع الخدمة الاختبار الأمني المستمر بنماذج ذكاء اصطناعي متعددة وخبرة Unit 42 الهجومية، بهدف اكتشاف مواضع الضعف والتحقق من قابلية استغلالها وترتيب معالجتها. وهي تفحص تطبيقات الويب وواجهات API والبنية السحابية ومستودعات الشفرة وأصول الشبكة مع تغير بيئة المؤسسة.

تفسير الجمع بين النماذج يظهر في تغطية Axios لاختبارات الشركة: لم يرصد أي نموذج منفرد أكثر من 40% من الثغرات في بيئة مؤسسية معقدة، وكان التداخل بين ما وجده Claude Mythos 5 وما وجده GPT-5.6-Cyber أقل من 10%. لذلك تستخدم الخدمة هذين النموذجين، إلى جانب نماذج مفتوحة الأوزان، بدل الاعتماد على نتيجة نموذج واحد. الأرقام تشرح قرار التصميم، لكنها لا تمثل معدل اكتشاف مضمونًا لكل عميل.

لماذا تحتاج الخدمة إلى أكثر من نموذج؟

توزع طبقة التنسيق مهام الاختبار على النموذج الذي تراه أنسب لكل مهمة. فاختلاف النتائج في اختبارات الشركة يعني أن الاقتصار على أحد النموذجين قد يترك مواضع ضعف وجدها الآخر؛ أما جمع النتائج فيتيح فحص مساحة أوسع قبل أن يبدأ التحقق من الخطر الفعلي. ولا يكفي انخفاض التداخل وحده لحساب نسبة تغطية نهائية، لأن بعض الثغرات قد تفلت من جميع النماذج المستخدمة.

النموذج هنا جزء من طريقة الفحص، وليس حكمًا مستقلًا على خطورة كل نتيجة. فقد يعثر الفحص على خلل منفرد في تطبيق، بينما يتوقف أثره الأمني على إمكان وصله بخلل آخر للوصول إلى حساب أو مورد حساس. ولهذا تفصل الخدمة بين الإشارة الأولية إلى موضع ضعف ومحاكاة مسار هجوم قابل للاستغلال؛ هذا الفصل يحدد أي النتائج تستحق المعالجة العاجلة.

يتوقف ما تستطيع هذه الآلية رؤيته أيضًا على الأصول التي تدخل نطاق الاختبار. إذا اقتصر الوصول الممنوح للخدمة على بعض التطبيقات، فلن يصف تقريرها بقية بيئة المؤسسة، مهما تعددت النماذج. تلك نتيجة مباشرة لحدود الفحص، وينبغي أخذها في الحسبان عند تفسير أي قائمة ثغرات أو ترتيب أولويات ينتج عن الخدمة.

ماذا يغطي الاختبار المستمر، وأين تبدأ المعالجة؟

تبدأ الآلية المعلنة بفحص أساسي للأصول الداخلة في النطاق، ثم تواصل الاختبار عندما تتغير البيئة. ويشمل الفحص تطبيقات الويب التي تملكها المؤسسة وتطبيقات أطراف ثالثة، فضلًا عن واجهات البرمجة والشفرة والبنية السحابية وأصول الشبكة. معنى «المستمر» هنا متابعة التغيرات في الأصول المشمولة؛ ولا يحدد الإعلان وتيرة موحدة لإعادة فحص كل أصل أو شروط الوصول إليه في جميع المؤسسات.

تحاول محاكاة الهجوم وصل مواضع ضعف متفرقة في مسار يمكن استغلاله من البداية إلى النهاية. هذه خطوة مختلفة عن تسجيل وجود ثغرة معروفة في ماسح تقليدي: فقد تظهر مشكلة من تفاعل إعدادات أو وظائف لا تكشفها مطابقة اسم الثغرة وحدها. لكن إثبات المسار في بيئة الاختبار لا يصف تلقائيًا أثره التشغيلي في كل نظام إنتاجي؛ تظل صلاحيات الوصول وحدود المحاكاة وطريقة التحقق عوامل مؤثرة في النتيجة.

بعد التحقق، تقدم الخدمة إصلاحات مرتبة بحسب الأولوية، وإرشادات على مستوى الشفرة، وتوصيات برقع افتراضية. أما تنفيذ الرقعة الافتراضية فيرتبط بإقرانها بخدمة Frontier Virtual Patching المنفصلة. وعليه فإن ظهور توصية بالمعالجة لا يعني أن تغييرًا طُبق بالفعل، أو أن المسار الذي كشفه الاختبار زال من بيئة العميل. بين الاكتشاف والتنفيذ تبقى هناك قرارات تخص اعتماد الإصلاح واختبار أثره وإعادة التحقق منه.

ما حدود أرقام الفاعلية المنشورة؟

مقام نسبة اكتشاف النموذج المنفرد هو الثغرات التي ظهرت في تقييم الشركة لبيئة معقدة، وليس جميع الثغرات الموجودة فعليًا في أي مؤسسة. كما أن تداخل النتائج يقارن ما اكتشفه نموذجان، ولا يقيس وحده نسبة الإنذارات الخاطئة أو الوقت اللازم لإصلاح ما عُثر عليه. لذلك تفيد النسبتان في تفسير الحاجة إلى نماذج متعددة أكثر مما تفيدان في توقع حصيلة فحص بيئة جديدة.

وتعرض مادة Unit 42 عن منهج الخدمة نتائج أخرى من نشرها الداخلي وتقول إن بنية عدم الاحتفاظ بالبيانات تحمي الشفرة المصدرية وبيانات القياس من الاحتفاظ بها أو استخدامها لتدريب نماذج عامة. هذه إفادات من مقدم الخدمة عن طريقة عمله، وليست قياسًا مستقلًا لأدائها أو بيانًا تفصيليًا لتدفق بيانات كل عميل. كما لا تنشر المادة معدلًا عامًا للنتائج الإيجابية الكاذبة يمكن نقله بين البيئات.

من المهم أيضًا تمييز نطاق كل نتيجة تعرضها الشركة. فنتائج الفحص داخل بنيتها، وما رصدته في تعاملات العملاء، وأداء نموذج منفرد في مقارنة داخلية ليست اختبارًا واحدًا له المقام والشروط نفسيهما. جمعها في رقم واحد عن «فاعلية الخدمة» سيخفي اختلاف الأصول المختبرة وطريقة التحقق والجهة التي أجرت القياس. ولا تقدم مواد الإطلاق مقارنة مستقلة ومتكافئة مع اختبار اختراق بشري عبر مؤسسات متعددة.

هل تستبدل الخدمة المختبر الأمني البشري؟

وصف الخدمة يجمع النماذج مع خبرة Unit 42 الهجومية ومعلومات التهديد؛ فلا يقدم الفحص الآلي باعتباره بديلًا كاملًا عن المختبرين. تستطيع النماذج توسيع البحث عن مواضع الضعف وتسريع اختبار المسارات المحتملة، بينما يحتاج تقدير أهمية النتيجة إلى سياق الأصل المتأثر والبيانات التي يمكن بلوغها والضوابط القائمة حوله. وقد تتطلب المعالجة تغييرًا في الشفرة أو الإعدادات أو قواعد الحماية، ولكل تغيير أثر ينبغي مراجعته داخل المؤسسة.

هذا التمييز مهم خصوصًا حين يلامس الفحص تطبيقًا تابعًا لطرف ثالث أو بيئة إنتاج لا تحتمل اختبارًا مفتوح الصلاحيات. نطاق الأصول المسموح بفحصها، ومستوى الوصول إلى الشفرة وواجهات البرمجة، والقيود المفروضة على محاكاة الاستغلال، أمور تحدد ما يمكن إثباته بأمان. ولا توضح مواد الإطلاق ترتيبات موحدة لهذه المسائل تصلح لكل عميل؛ فهي تعتمد على بيئة المؤسسة وشروط تقديم الخدمة.

ما الذي يحتاجه تقييم الخدمة لدى المؤسسات؟

بالنسبة إلى فرق الأمن في الشرق الأوسط وشمال أفريقيا، يبدأ تقييم العرض بتحديد الأصول الداخلة فعلًا في الاشتراك، ثم معرفة أي النتائج مجرد اكتشاف وأيها مسار استغلال جرى التحقق منه. ويلزم فصل توصية الإصلاح عن تنفيذها: من يعتمد التغيير، ومن يعيد الفحص بعده، وكيف تظهر النتيجة إذا تعذر منح الخدمة صلاحية الوصول إلى أصل حساس؟ هذه أسئلة عن نطاق المنتج ومسؤولية التشغيل، وليست مزايا إضافية ثبت توفرها تلقائيًا.

يبقى مسار البيانات جزءًا من التقييم نفسه: ما الذي يصل إلى النماذج من الشفرة وبيانات القياس، وكيف تُطبق ترتيبات عدم الاحتفاظ المعلنة في الخدمة المتعاقد عليها؟ كما يحتاج المشتري إلى معرفة طريقة فرز الإيجابيات الكاذبة ودور المراجعة البشرية قبل تحويل النتائج إلى أعمال إصلاح. الثابت في مواد الإطلاق هو إتاحة الاشتراك ونهج الفحص متعدد النماذج؛ أما أداء الخدمة في بيئة بعينها وتفاصيل الوصول والتحقق، فتحتاج إلى شروط وبيانات تخص تلك البيئة.

اقرأ أيضًا:

مشاركة:

اشترك في نشرتنا الإخبارية

احصل على أحدث أخبار الويب 3 والذكاء الاصطناعي والعملات المشفرة مباشرة في بريدك.

0