محققان در یک پژوهش تازه، به سراغ یکی از رفتارهای عجیب مدلهای زبانی بزرگ (LLM) رفتند: «سایکوفنسی» یا همان تمایل مدل به تایید نظرات کاربر، حتی زمانی که کاربر اشتباه میکند! 🤐
در این مطالعه، این رفتار به دو دسته «واقعگرایانه» و «نظری» تقسیم شده تا مشخص شود مدلها چگونه این اطلاعات را در لایههای درونی خود پردازش میکنند. این دستاورد به دانشمندان کمک میکند تا با ابزارهای دقیقتر، جلوی این رفتار جهتگیرانه و غیرمنطقی مدلها را بگیرند و آنها را به سمت ارائه پاسخهای صادقانهتر هدایت کنند.
پیشرفتی که میتواند هوش مصنوعی را به دستیاری قابلاعتمادتر تبدیل کند! 🧠✨
منبع: arXiv Machine Learning
