محققان در پژوهشی تازه، راهکار جدیدی به نام «RoME» ارائه دادهاند که هدف آن مقاومسازی مدلهای هوش مصنوعی در برابر حملات خصمانه (Adversarial Perturbations) است.
چالش بزرگ مدلهای فعلی این است که وقتی برای مقابله با چندین تهدید مختلف آموزش میبینند، دچار افت عملکرد میشوند. مدل RoME با استفاده از «ترکیب کارشناسان با رتبه پایین» (Low-Rank Mixture of Experts)، به مدل اجازه میدهد تا ویژگیهای مشترک را به صورت اشتراکی یاد بگیرد و در عین حال، برای هر نوع حمله، مسیرهای تخصصی خاصی ایجاد کند.
این روش نه تنها دقت مدل را در شرایط عادی حفظ میکند، بلکه مقاومت آن را در برابر تهدیدات دیده نشده نیز به شکل چشمگیری افزایش میدهد. کدهای این پروژه هم برای استفاده محققان در گیتهاب منتشر شده است.
🔗 لینک پروژه: https://github.com/wkim97/RoME
منبع: arXiv AI
