حتماً میدانید که مدلهای بزرگ زبانی (LLM) اطلاعات زیادی را در دل میلیاردها پارامتر خود ذخیره میکنند. اما مشکل کجاست؟ این مدلها گاهی اطلاعات حساس شخصی، مطالب دارای کپیرایت یا دادههای خطرناک را حفظ میکنند که پاک کردن آنها بدون آموزش مجدد کل مدل، به یک چالش امنیتی بزرگ تبدیل شده است.
در مقالهای جدید، محققان به بررسی تخصصی مفهوم «Unlearning» یا همان یادگیریِ فراموشی پرداختهاند. این پژوهش نشان میدهد که چطور میتوان دانش ناخواسته را بدون آسیب به تواناییهای کلی مدل، از آن حذف کرد تا از حملات سایبری و نشت اطلاعات جلوگیری شود. این موضوع یکی از ترندهای داغ و حیاتی در امنیت سیستمهای هوش مصنوعی است. 🔐✨
منبع: arXiv Machine Learning
