محققان در یک پژوهش علمی جدید، برای اولین بار یک «نظریه روانسنجی» اختصاصی برای مدلهای زبانی ارائه کردهاند تا بفهمیم وقتی یک هوش مصنوعی از «خودش» میگوید، دقیقاً چه اتفاقی در حال رخ دادن است.
نکته کلیدی این تحقیق این است که پاسخهای مدلها به پرسشهای انسانی، ترکیبی از دو فرآیند مجزاست: یکی «نصب پرسونای» مدل که در مرحله آموزش نهایی (Post-training) ایجاد شده، و دیگری «کنترل انتساب» که مانع از ادعاهای خطرناک یا غیرواقعی میشود.
این تیم با طراحی «پرسشنامه پینوکیو» (Pinocchio Inventory)، توانستند با دقت بالایی ساختار گزارشدهی مدلها را تحلیل کنند و متوجه شدند که فرآیندهای شخصیتی مدلها کاملاً تحت تأثیر آموزشهای نهایی آنهاست. گامی بسیار مهم برای درک بهتر «ذهن» مصنوعی مدلهای LLM! 🤖✨
منبع: arXiv NLP
