آیا هوش مصنوعی میتواند امنیت نرمافزارها را تضمین کند؟ محققان بهتازگی بنچمارک جدیدی به نام «HoF-Bench» را معرفی کردهاند که عملکرد مدلهای زبانی را در کشف آسیبپذیریهای واقعی (CVE) در پروژههای متنباز ارزیابی میکند.
نکته جالب اینجاست که این تحقیق بدون تکیه بر مدلهای بسیار بزرگ و گرانقیمت (Frontier Models) انجام شده و نشان میدهد که مدلهای کوچکتر و بهینهتر هم میتوانند با دقت بالایی در شناسایی حفرههای امنیتی در کدهای پیچیده عمل کنند. این ابزار به توسعهدهندگان کمک میکند تا امنیت کدهای خود را با استاندارد دقیقتری بسنجند.
نویسی
منبع: arXiv Machine Learning
