محققان دانشگاه برکلی ابزار متنباز جدیدی به نام «ExploitGym» منتشر کردهاند که دنیای بنچمارکهای هوش مصنوعی را کمی متفاوتتر دیده است! این پلتفرم با هدف ارزیابی قابلیتهای امنیتی و توانایی مدلها در شناسایی و اجرای اکسپلویتها طراحی شده است.
در دنیایی که هوش مصنوعی در حال نفوذ به بخشهای حساس است، وجود چنین ابزارهایی برای سنجشِ «امنیت» و «تست نفوذ» مدلها بسیار حیاتی به نظر میرسد. این بنچمارک به توسعهدهندگان کمک میکند تا بفهمند مدلهایشان در برابر تهدیدات سایبری چقدر هوشمند یا آسیبپذیر هستند.
🔗 کد منبع این پروژه را میتوانید در گیتهاب بررسی کنید.
منبع: Hacker News AI