محققان در مقالهای جدید به سراغ چالش «فراموشی» در مدلهای زبانی بزرگ (LLMs) رفتهاند. با پیشرفت مدلها، ما مدام آنها را بهروزرسانی میکنیم، اما آیا این مدلها دانش قبلی خود را حفظ میکنند؟
ابزار جدیدی به نام ForgetBench معرفی شده که به طور تخصصی نحوه «فراموشی» و «پایداری دانش» را در طول زمان و در مواجهه با بهروزرسانیهای مداوم بررسی میکند. نتایج اولیه نشان میدهد که روشهای فعلی هنوز نمیتوانند تعادل مناسبی بین یادگیری اطلاعات جدید و حفظ دانش قدیمی برقرار کنند.
این تحقیق گامی مهم برای ساخت مدلهای هوشمندتر و پایدارتر در آینده است. 🚀
منبع: arXiv AI
