یکی از بزرگترین چالشهای هوش مصنوعی این است که قوانین امنیتی و تهدیدها مدام تغییر میکنند. حالا محققان «AIR-BENCH Live» را معرفی کردهاند؛ یک سیستم هوشمند که برخلاف بنچمارکهای قدیمی، بهصورت خودکار با قوانین جدید جهانی بهروز میشود.
ویژگیهای کلیدی این ابزار:
✅ بهروزرسانی خودکار با رصد قوانین جدید حوزهی AI
✅ گسترش تستهای امنیتی از ۳۱۴ به ۳۳۵ ریسک مختلف
✅ استفاده از الگوریتمهای چندعامله برای تولید پرامپتهای تست واقعی و چندزبانه
این پروژه نشان میدهد که چرا مدلهای فعلی در برابر تهدیدات جدید چقدر آسیبپذیرند و چطور میتوان با «تکامل مداوم» امنیت هوش مصنوعی را در برابر حملات مدرن تضمین کرد. 🚀
منبع: arXiv AI
