مايكروسوفت تكشف عن نموذج ذكاء اصطناعي للأمن السيبراني يرفع أداء MDASH إلى 95.95% بنصف التكلفة

أطلقت شركة Microsoft أول نموذج متخصص في الأمن السيبراني ضمن نظامها MDASH، وهو إطار متعدد النماذج لاكتشاف الثغرات ومعالجتها. النموذج الجديد، المسمى MAI-Cyber-1-Flash، يعمل جنبًا إلى جنب مع GPT-5.4، وحقق نتيجة 95.95% في اختبار CyberGym Level 1، وهو اختبار لإعادة اكتشاف ثغرات معروفة عبر وصفها وكودها غير المرقع. مايكروسوفت أوضحت أن النموذج الجديد قادر على معالجة ما يصل إلى 90% من مهام MDASH، بينما يُخصص GPT-5.4 لأصعب 10%، مما يحقق توازنًا بين الأداء والتكلفة. النتيجة المعلنة تخص النظام ككل وليس النموذج منفردًا.

وفورات في التكلفة وأداء مقارن

تقول الشركة إن التشكيلة الجديدة تقلل التكلفة بنسبة 50% مقارنة بأفضل مزيج سابق من نماذج MDASH (GPT-5.4، GPT-5.4 mini، GPT-5.3 Codex). ومع ذلك، لم تكشف مايكروسوفت عن تفاصيل دقيقة مثل حجم الاستدعاءات أو زمن الاستجابة أو توزيع المهام، ما يجعل من الصعب التحقق المستقل من هذه الأرقام. الجدير بالذكر أن لوحة نتائج CyberGym العامة لم تُدرج نتيجة 95.95% عند مراجعتها في 28 يوليو 2026، حيث تصدرت أداة Atlas من Wiz بنسبة 90.9%، بينما بقيت مشاركة مايكروسوفت السابقة عند 88.4%.

الخصائص التقنية للنموذج

وفق بطاقة النموذج، فإن MAI-Cyber-1-Flash يعتمد على بنية Sparse Mixture-of-Experts Transformer، بعدد إجمالي 137 مليار معامل، منها 5 مليارات نشطة، مع نافذة سياق تصل إلى 256 ألف رمز. النموذج هو نسخة معدلة من MAI-Code-1-Flash، تم تدريبه من نقطة MAI-Thinking-1. التصميم يركز على التوجيه الذكي للمهام: النموذج الجديد يتولى معظم العمليات، بينما يُسند الجزء الأصعب إلى GPT-5.4، ما يعزز الكفاءة ويخفض التكلفة.

نتائج إضافية وتحذيرات تشغيلية

في اختبارات أخرى، سجل النموذج نتائج متفاوتة:

  • 0.314 على CVEBench
  • 0.553 على CyberSecEval4
  • 0.33 في اختبار تحليل البرمجيات الخبيثة
  • 0.651 على CRSBench عند POV=1200 بينما سجل صفرًا في جميع فئات ExploitGym (النواة، المستخدم، المتصفح)، ما يشير إلى محدودية قدرته على توليد استغلالات عملية. مايكروسوفت شددت على أن جميع الاختبارات أجريت في بيئة معزولة عن الشبكة، وأن النصوص والرموز المولدة قد تكون غير دقيقة أو غير مكتملة، ما يستلزم مراجعتها قبل الاستخدام الفعلي.
مشروع Perception وتوسيع الاستخدامات

إدماج النموذج الجديد في إدارة الثغرات عبر MDASH يمثل أول تطبيق معلن ضمن مشروع Perception، وهو نظام أوسع لتنسيق وكلاء الأمن الدفاعي. المشروع سيدخل مرحلة المعاينة العامة في 3 أغسطس 2026، مع خطط لتوسيع استخدام النموذج إلى مجالات أمنية إضافية تتجاوز إدارة الثغرات البرمجية.

محمد وهبى
محمد وهبى
المقالات: 1338

اترك ردّاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *


The reCAPTCHA verification period has expired. Please reload the page.