یکی از چالشهای اصلی در پردازش متنهای خیلی طولانی توسط مدلهای هوش مصنوعی، محدودیت حافظه و کاهش دقت در درک جزئیات است. حالا محققان فریمورک جدیدی به نام «PReM» (مخفف Preserve and Refresh Memory) معرفی کردهاند.
این روش به مدل اجازه میدهد هوشمندانه تصمیم بگیرد کدام بخش از اطلاعات قبلی را حفظ کند و چه زمانی حافظه خود را «رفرش» کند. با این تکنیک، مدلهای زبانی حتی در پردازشهای سنگین (۳۲ هزار توکن)، هم سرعت و کارایی بالاتری دارند و هم کیفیت پاسخدهیشان به طرز چشمگیری بهبود پیدا میکند. این یعنی خداحافظی با فراموشی جزئیات در چتهای طولانی! 🧠💡
منبع: arXiv NLP
