یکی از بزرگترین چالشهای مدلهای زبانی بزرگ (LLM)، مدیریت حافظه در گفتگوهای طولانی است. حالا محققان با معرفی لایه جدید VISTA، این مشکل را حل کردهاند.
در روشهای قدیمی، مدلها متوجه محدودیتهای حافظه خود نیستند، اما VISTA با ایجاد یک «داشبورد هوشمند» از وضعیت توکنها و تاریخچه دسترسیها، به مدل کمک میکند بفهمد دقیقاً چه زمانی باید اطلاعات را فشرده یا بازیابی کند. این یعنی دقت مدلهایی مثل Gemini-3-Flash در وظایف پیچیده تا بیش از دو برابر افزایش یافته است! 🚀
این نوآوری بدون نیاز به آموزش مجدد (Training-free) روی مدلهای مختلف اجرا میشود و یک گام بزرگ برای ساخت «عاملهای هوشمند» (Agents) کارآمدتر است.
منبع: arXiv NLP
