محققان در مطالعهای جدید، پروتکل نوآورانهای به نام LENS را معرفی کردهاند که به بررسی و ارزیابی «فراموشی ماشین» (Machine Unlearning) میپردازد. این ابزار دقیق مشخص میکند که آیا الگوریتمهای فعلی واقعاً میتوانند روایتهای جهتدار و اطلاعات نادرست را از حافظه مدلهای هوش مصنوعی پاک کنند یا خیر.
🔹 نکات کلیدی این پژوهش:
✅ معرفی معیار SCE برای سنجش میزان حذف اطلاعات بدون آسیب به دانش عمومی مدل.
✅ بررسی مدلهای پیشرفته (مانند Qwen و Gemma) در برابر روایتهای سیاسی.
✅ کشف این موضوع که مدلها گاهی پس از unlearning، دوباره اطلاعات حذفشده را بازیابی میکنند!
این تحقیق گامی مهم برای افزایش شفافیت و اخلاق در توسعه مدلهای زبانی بزرگ است.
منبع: arXiv NLP



