مدلهای بزرگی مثل ChatGPT و Gemini گاهی دادههای حساس یا نادرستی را در حافظه خود نگه میدارند که نگرانیهای زیادی ایجاد کرده است. حالا محققان راهکار جذابی ارائه دادهاند: «یادگیریزدایی رفتاری» (Behavioral Unlearning) مبتنی بر RAG.
در این روش، بهجای تغییر مستقیم و هزینهبرِ مدل، کافیست پایگاه دانش خارجی RAG را ویرایش کنیم! این یعنی بدون نیاز به بازآموزیهای سنگین، میتوانیم اطلاعات نامطلوب را حذف کنیم. این تکنیک برای مدلهای بسته (Closed-source) که دسترسی به ساختار داخلیشان نداریم، یک تحول بزرگ محسوب میشود. 🛠️✨
منبع: arXiv NLP
