Key points are not available for this paper at this time.
نظام كشف التسلل (IDS) هو أداة هامة في تطبيقات الأمان في أنظمة المعلومات المتصلة الحديثة. الحصول على تكوين مثالي لنظام كشف التسلل لكشف الهجمات بشكل فعال ليس بالأمر السهل. هناك توازن بين مستويات تطبيق الأمان وأداء أنظمة المعلومات. من الضروري تكوين نظام كشف التسلل بطريقة ديناميكية وتكرارية لتحقيق توازن بين تكلفة الأمان وأداء النظام. في هذه الورقة، نستخدم طرق الألعاب غير التعاونية لمعالجة هذه المشكلة. أولاً، نبني إطار عمل أساسي للألعاب لنموذج التفاعلات صفرية المجموع بين المكتشف والمهاجم. استنادًا إلى هذه المنصة، نقوم بصياغة نموذج لعبة عشوائية يتم فيها تحديد الانتقالات بين حالات النظام بواسطة الإجراءات التي يختارها كلا اللاعبين. يمكن العثور على تكوين مثالي يعتمد على السياسة من خلال تقليل معيار التكلفة المخصومة، باستخدام طريقة تكرارية. بالإضافة إلى ذلك، نقترح خوارزمية تعلم قائم على Q لإيجاد القيم المثلى للعبة عندما تكون الانتقالات بين حالات النظام غير معروفة. نظهر تقارب الخوارزمية نحو دالة Q المثلى ونوضح المفاهيم من خلال المحاكاة.
درس زو وآخرون (الثلاثاء) هذا السؤال.