آیا هوش مصنوعی واقعاً میتواند کدهای جاوا را از نظر امنیتی تحلیل کند؟ محققان بهتازگی بنچمارک جدید و جامع «JavaVulBench» را معرفی کردهاند که به طور اختصاصی برای ارزیابی قابلیتهای تشخیص آسیبپذیری (CVE) در مدلهای زبانی طراحی شده است.
این پروژه شامل:
✅ بیش از ۳۰ هزار متد جاوا و ۱۷۰۰ آسیبپذیری واقعی
✅ مقایسه دقیق مدلهای بزرگی مثل GPT-4o، Claude Sonnet و مدلهای متنباز مثل DeepSeek
✅ امکان بررسی اینکه آیا مدلها واقعاً هوشمند هستند یا فقط دادههای آموزشی را حفظ کردهاند!
این ابزار به توسعهدهندگان و محققان امنیت کمک میکند تا با دقت بسیار بالاتری، کدهای تولید شده توسط هوش مصنوعی را قبل از استقرار در محیطهای حساس ارزیابی کنند. امنیت نرمافزار با هوش مصنوعی وارد فاز جدیدی شده است. 🚀
منبع: arXiv AI
