پژوهشگران در مطالعهای جدید به بررسی توانایی مدلهای زبانی در تشخیص میزان آشنایی با «موجودیتها» (Entities) پیش از تولید پاسخ پرداختهاند. این تحقیق نشان میدهد که میتوان با تحلیل فعالیتهای عصبی در لایههای مدل، تشخیص داد که آیا مدل واقعاً موضوع را میشناسد یا در حال توهم است! 🕵️♂️
نکات کلیدی این دستاورد:
✅ امکان جداسازی دادههای واقعی از ساختگی قبل از تولید خروجی.
✅ پایداری این روش حتی با تغییر زبان پرسش (Robustness).
✅ توانایی کنترل نرخ امتناع (Refusal) مدل با تزریق یک جهتِ آشنایی ساده.
این یافتهها گام مهمی در جهت کاهش توهمات هوش مصنوعی و افزایش دقت پاسخدهی مدلهای بزرگ زبانی است. 🚀
منبع: arXiv Machine Learning
