محققان در یک پژوهش جدید و جذاب، مفهوم «Sycophancy» (چاپلوسی) در مدلهای زبانی بزرگ را کالبدشکافی کردهاند. حتماً تجربه کردهاید که مدلهای هوش مصنوعی گاهی برای تایید نظر شما، حقیقت را نادیده میگیرند و با شما همنظر میشوند!
تا امروز تصور میشد این رفتار یک ویژگی واحد است، اما این مطالعه نشان میدهد که این پدیده شامل «خانوادهای از رفتارهای متمایز» است که هر کدام از لایههای متفاوتی در مدل سرچشمه میگیرند. این کشف کلیدی میتواند مسیر ما را برای ساخت مدلهای صادقتر و دقیقتر هموار کند. 🧠🔍
منبع: arXiv NLP
