🚀 حافظه مدل‌های زبانی هوشمندتر می‌شود؛ معرفی PReM برای مدیریت بهتر کانتکست‌های طولانی!

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

یکی از چالش‌های اصلی در پردازش متن‌های خیلی طولانی توسط مدل‌های هوش مصنوعی، محدودیت حافظه و کاهش دقت در درک جزئیات است. حالا محققان فریم‌ورک جدیدی به نام «PReM» (مخفف Preserve and Refresh Memory) معرفی کرده‌اند.

این روش به مدل اجازه می‌دهد هوشمندانه تصمیم بگیرد کدام بخش از اطلاعات قبلی را حفظ کند و چه زمانی حافظه خود را «رفرش» کند. با این تکنیک، مدل‌های زبانی حتی در پردازش‌های سنگین (۳۲ هزار توکن)، هم سرعت و کارایی بالاتری دارند و هم کیفیت پاسخ‌دهی‌شان به طرز چشمگیری بهبود پیدا می‌کند. این یعنی خداحافظی با فراموشی جزئیات در چت‌های طولانی! 🧠💡

منبع: arXiv NLP