🛡️ شکارچی جدید حفره‌های امنیتی: معرفی بنچمارک HoF-Bench

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

آیا هوش مصنوعی می‌تواند امنیت نرم‌افزارها را تضمین کند؟ محققان به‌تازگی بنچمارک جدیدی به نام «HoF-Bench» را معرفی کرده‌اند که عملکرد مدل‌های زبانی را در کشف آسیب‌پذیری‌های واقعی (CVE) در پروژه‌های متن‌باز ارزیابی می‌کند.

نکته جالب اینجاست که این تحقیق بدون تکیه بر مدل‌های بسیار بزرگ و گران‌قیمت (Frontier Models) انجام شده و نشان می‌دهد که مدل‌های کوچک‌تر و بهینه‌تر هم می‌توانند با دقت بالایی در شناسایی حفره‌های امنیتی در کدهای پیچیده عمل کنند. این ابزار به توسعه‌دهندگان کمک می‌کند تا امنیت کدهای خود را با استاندارد دقیق‌تری بسنجند.

‌نویسی

منبع: arXiv Machine Learning