حتماً برایتان پیش آمده که از یک مدل زبانی (LLM) سوالی بپرسید اما پاسخی دریافت کنید که با وجود «درست» بودن، اصلاً همان چیزی نیست که مد نظرتان بوده! محققان در پژوهش جدیدی متوجه شدند که مدلهای فعلی، با وجود نمرات بالا در بنچمارکها، هنوز در درکِ «انتظارات واقعی کاربران» ضعف دارند.
تیم محققان برای حل این مشکل، دو دستاورد مهم ارائه کردهاند:
۱. بنچمارک جدیدی به نام ExpectBench که بر اساس انتظارات واقعی انسانها طراحی شده است.
۲. چارچوب LENS که به مدل اجازه میدهد انتظارات ضمنی کاربر را بهتر درک کرده و پاسخهای دقیقتر و هوشمندانهتری تولید کند.
این یعنی قدمی بزرگ برای اینکه هوش مصنوعی نه فقط یک ماشینِ جوابدهنده، بلکه دستیاری «همسو با ذهن ما» باشد. 🚀
منبع: arXiv AI
