یکی از چالشهای بزرگ مدلهای زبانی (LLM) در انجام کارهای پیچیده، مدیریت اطلاعات زیاد و گاهی بیفایده است که باعث کاهش دقت در استدلال میشود. محققان به تازگی چارچوب جدیدی به نام «SF-AMS» معرفی کردهاند که یاد گرفته چطور به صورت هوشمند و استراتژیک، اطلاعات غیرضروری را فراموش کند.
این سیستم با اولویتبندی حافظه بر اساس میزان استفاده و اهمیت، کمک میکند مدلهایی مثل Qwen و GPT-4o در کارهای چندمرحلهای و طولانی، بسیار دقیقتر عمل کنند و اطلاعات کلیدی را بهتر حفظ کنند. این یعنی پایان سردرگمی مدلهای هوش مصنوعی در پروژههای سنگین و طولانی!
منبع: arXiv AI
