🧠 آیا می‌توان مدل‌های زبانی را از «اطلاعات سوگیرانه» پاک کرد؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در مطالعه‌ای جدید، پروتکل نوآورانه‌ای به نام LENS را معرفی کرده‌اند که به بررسی و ارزیابی «فراموشی ماشین» (Machine Unlearning) می‌پردازد. این ابزار دقیق مشخص می‌کند که آیا الگوریتم‌های فعلی واقعاً می‌توانند روایت‌های جهت‌دار و اطلاعات نادرست را از حافظه مدل‌های هوش مصنوعی پاک کنند یا خیر.

🔹 نکات کلیدی این پژوهش:
✅ معرفی معیار SCE برای سنجش میزان حذف اطلاعات بدون آسیب به دانش عمومی مدل.
✅ بررسی مدل‌های پیشرفته (مانند Qwen و Gemma) در برابر روایت‌های سیاسی.
✅ کشف این موضوع که مدل‌ها گاهی پس از unlearning، دوباره اطلاعات حذف‌شده را بازیابی می‌کنند!

این تحقیق گامی مهم برای افزایش شفافیت و اخلاق در توسعه مدل‌های زبانی بزرگ است.

منبع: arXiv NLP