🚀 چالش جدید دنیای LLMها: آیا مدل‌ها در درک علایق کاربران «سلیقه‌ای» عمل می‌کنند؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در مقاله جدیدی، بنچمارک جذابی به نام «StreamProfileBench» را معرفی کرده‌اند که به بررسی یکی از نقاط ضعف مهم مدل‌های زبانی بزرگ می‌پردازد: «پروفایل‌سازی پویا از کاربر»!

🔹 ماجرا چیست؟ اکثر مدل‌های فعلی، کاربر را ثابت فرض می‌کنند، اما در دنیای واقعی، علایق ما مدام تغییر می‌کند. محققان با بررسی ۱۲۰ هزار پست از ۷ هزار کاربر واقعی، متوجه شدند که اکثر مدل‌های پیشرو دچار یک «سوگیری محافظه‌کارانه» هستند؛ یعنی تمایل دارند علایق قدیمی کاربر را بیش از حد حفظ کنند و تغییرات جدید (Interest Decay) را نادیده بگیرند.

این بنچمارک جدید که شامل دیتاست‌های واقعی و بدون نیاز به برچسب‌گذاری (Annotation-free) است، می‌تواند راهگشای سیستم‌های توصیه‌گر هوشمندتر باشد تا بالاخره بفهمند سلیقه ما در طول زمان چطور تغییر می‌کند. 🧠✨

🔗 کد و دیتای این پروژه در گیت‌هاب برای علاقه‌مندان در دسترس است.

منبع: arXiv NLP