آیا میدانستید که قابلیت تطبیقپذیری مدلهای هوش مصنوعی میتواند پاشنه آشیل آنها باشد؟ محققان بهتازگی متد جدیدی به نام BadTV را معرفی کردهاند که در آن، هکرها با استفاده از «بردارهای وظیفه» (Task Vectors)، در مدلهای یادگیری عمیق درهای پشتی (Backdoor) ایجاد میکنند.
این حمله به قدری هوشمندانه طراحی شده که حتی در عملیاتهای یادگیری یا فراموشی هم غیرفعال نمیشود و نرخ موفقیت بسیار بالایی دارد. این پژوهش زنگ خطری جدی برای امنیت مدلهایی است که به صورت ماژولار و سریع بهروزرسانی میشوند.
به نظر شما، آیا روشهای دفاعی فعلی میتوانند در برابر این نوع حملاتِ چندلایه مقاومت کنند؟
منبع: arXiv Machine Learning
