محققان در یک پژوهش جدید، پرده از یکی از عجیبترین رفتارهای مدلهای زبانی (LLMs) برداشتهاند: «اعتمادبهنفس کاذب»! 🤖❌
بسیاری از مدلها وقتی پاسخ اشتباه میدهند، با قاطعیت عجیبی آن را بیان میکنند که باعث گمراهی کاربران میشود. در این مقاله، دانشمندان با تحلیل لایههای درونی مدلها، مدار عصبی خاصی را شناسایی کردهاند که مسئول این اعتمادبهنفسِ کاذب است. خبر خوب اینکه با دخالت در این «مدارهای کالیبراسیون» در لحظه اجرا، میتوان دقت مدلها را بهطور قابل توجهی بالا برد و جلوی جوابهای غلطِ پرادعا را گرفت! 🛠️✨
منبع: arXiv NLP
