محققان در مقاله جدیدی، روشی نوآورانه به نام «HARVEY» معرفی کردهاند که به طور ویژه برای مقابله با حملات مسمومسازی دادهها (Data Poisoning) و حذف درهای پشتی در شبکههای عصبی طراحی شده است.
برخلاف روشهای قبلی که روی شناسایی دادههای سالم تمرکز داشتند، HARVEY با رویکردی متفاوت و هوشمندانه، مستقیماً مدلهای «مسموم» را هدف قرار داده و شناسایی میکند. این تغییر استراتژی باعث شده تا مدلهای نهایی نه تنها در برابر حملات ایمنتر باشند، بلکه دقتِ اصلی خود را نیز بدون افت قابل توجهی حفظ کنند.
این پیشرفت گام بزرگی برای افزایش امنیت مدلهای هوش مصنوعی در برابر حملات مخفیانه است. 🚀
منبع: arXiv Machine Learning
