🚀 معیار جدید برای سنجش حافظه در هوش مصنوعی: معرفی LMEB!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

آیا مدل‌های زبانی واقعاً می‌توانند جزئیات را «به‌خاطر بسپارند»؟ محققان به‌تازگی بنچمارک جدیدی به نام LMEB را برای ارزیابی توانایی مدل‌ها در بازیابی اطلاعاتِ «دیرپا و طولانی‌مدت» (Long-horizon Memory) معرفی کرده‌اند.

نکات کلیدی این پژوهش:
🔍 این بنچمارک شامل ۲۲ مجموعه داده و ۱۹۳ تسک مختلف است که جنبه‌های اپیزودیک، دیالوگ‌محور و رویه‌ای حافظه را بررسی می‌کند.
📊 نتایج نشان می‌دهد که مدل‌های بزرگ‌تر همیشه در یادآوری اطلاعات دقیق‌تر نیستند!
🧠 این تحقیق ثابت می‌کند که عملکرد خوب در جستجوی متون ساده، لزوماً به معنای توانایی مدل در حفظ حافظه بلندمدت نیست.

این بنچمارک گام مهمی است تا بفهمیم چطور می‌توانیم سیستم‌های هوشمند با حافظه‌ای شبیه‌تر به انسان بسازیم.

منبع: arXiv NLP