مدلهای زبانی با وجود هوشمندی بالا، همچنان در برابر حملات خصمانه (Adversarial Attacks) آسیبپذیر هستند؛ بهطوری که گاهی تغییرات کوچک در متن ورودی میتواند خروجی آنها را کاملاً به خطا بیندازد.
محققان در این مطالعه، چارچوب جدیدی به نام «CluCERT» را معرفی کردهاند که با استفاده از تکنیک «خوشهبندی» و حذف نویز، امنیت و دقت مدلها را به شکل چشمگیری افزایش میدهد. این روش نه تنها مرزهای ایمنی محکمتری ایجاد میکند، بلکه با بهینهسازی محاسبات، سرعت پردازش را نیز بهبود میبخشد.
این دستاورد میتواند گامی مهم برای استفاده امنتر از هوش مصنوعی در کاربردهای حساس باشد. 🤖✨
منبع: arXiv Machine Learning
