🛡️ آیا هوش مصنوعی می‌تواند امنیت نرم‌افزارها را تامین کند؟ معرفی بنچمارک SEC-bench Pro 💻

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

دنیای امنیت سایبری با یک چالش بزرگ روبروست؛ آیا مدل‌های زبانی توانایی کشف حفره‌های امنیتی پیچیده در کدهای سنگین را دارند؟ پژوهشگران با معرفی SEC-bench Pro سعی کرده‌اند به این سوال پاسخ دهند.

این بنچمارک با بررسی ۳۴۴ آسیب‌پذیری واقعی در سیستم‌های پیچیده‌ای مثل هسته لینوکس و موتورهای مرورگر، عملکرد مدل‌های مختلف را به چالش کشیده است. جالب اینجاست که این مدل‌ها نه تنها در تست‌ها درخشیدند، بلکه در حین ارزیابی موفق به کشف ۳ آسیب‌پذیری جدید در مرورگرهای مطرح شدند!

با اینکه مدل‌های قدرتمند فعلی پیشرفت چشمگیری داشته‌اند، اما هنوز مسیر زیادی تا جایگزینی کامل متخصصان امنیت در پیش داریم.

منبع: arXiv Machine Learning