یکی از بزرگترین چالشهای مدلهای زبانی (LLM)، مدیریت حافظه طولانی و هزینه بالای پردازش تاریخچه گفتگوهاست. حالا محققان سیستمی به نام «Akashic» معرفی کردهاند که با استفاده از تکنولوژی MemAttention، به جای بازخوانی کل تاریخچه، حافظه را به تکههای بهینه تقسیم میکند.
این نوآوری چه دستاوردی دارد؟
✅ افزایش ۱۰ درصدی دقت در پاسخدهی
✅ بهبود ۱.۲ برابری در سرعت خروجی (Throughput)
✅ کاهش بار پردازشی و مدیریت بهتر منابع سختافزاری
این یعنی در آینده نزدیک، ایجنتهای هوش مصنوعی میتوانند با حافظهای بسیار طولانیتر و بدون افت کیفیت، پروژههای پیچیدهتری را برای ما پیش ببرند. 🧠✨
منبع: arXiv AI
