تا حالا دقت کردید که مدلهای زبانی بزرگ (LLM) چطور وقتی پنجره محتوا (Context Window) خیلی طولانی میشه، گیج میشن؟ مشکل اینجاست که این مدلها ذاتا نسبت به «وضعیت حافظه» خودشون کور هستن!
محققان ابزار جدیدی به نام VISTA رو معرفی کردن که مثل یک «داشبورد هوشمند» عمل میکنه. این لایه میانی به مدل اجازه میده وضعیت بلوکهای حافظه، زمان استفاده و دسترسیها رو ببینه. نتیجه؟ کارایی خیرهکننده! مثلا مدل Gemini-3-Flash با این روش تونست عملکردش رو در بنچمارکها بیش از دو برابر (از ۲۲.۷ به ۵۰.۷ درصد) ارتقا بده. 📈
این یعنی خداحافظی با فراموشی مدلهای هوش مصنوعی در پروژههای طولانی! 💡
منبع: arXiv NLP
