تا به حال بیشتر بنچمارکهای هوش مصنوعی روی سناریوهای قبل از حمله متمرکز بودند، اما یک تحقیق جدید با معرفی SecRespond، برای اولین بار ایجنتهای هوش مصنوعی را در محیطهای «پس از نفوذ» به چالش کشیده است!
در این بررسی، مدلهای زبانی باید با تحلیل اسنپشاتهای سیستمهای هکشده، گزارشهای فارنزیک بنویسند و برنامههای اصلاحی ارائه دهند. نتایج جالب و البته کمی نگرانکننده است: با اینکه مدلها در تشخیص مشکلات اولیه خوب عمل میکنند، اما هنوز برای شناسایی نفوذهای خاموش و ارائه راهکارهای امنیتی کامل، راه درازی در پیش دارند. 🤖💻
منبع: arXiv AI
