🔍 رمزگشایی از ذهن هوش مصنوعی: MafiaScope وارد می‌شود!

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

تا حالا فکر کردید که یک مدل زبانی (LLM) موقع بازی کردن، واقعاً چی توی سرش می‌گذره؟ آیا فقط بلوف می‌زنه یا واقعاً بازی رو تحلیل کرده؟

محققان ابزار جدیدی به نام «MafiaScope» طراحی کردند که بازی معروف «مافیا» رو به یک آزمایشگاه دقیق برای بررسی «نظریه ذهن» (Theory of Mind) در هوش مصنوعی تبدیل کرده. این سیستم با پرسش‌های ساختاریافته در حین بازی، بررسی می‌کنه که آیا تصمیم‌های مدل از روی استدلال منطقی بوده یا فقط یک حدس شانسی!

نتایج جالبی هم به دست اومده؛ مثلاً مدل‌ها معمولاً اعتمادبه‌نفس کاذب دارن و توی درک شرایط محیطی گاهی دچار خطاهای جالبی میشن. این ابزار کمک می‌کنه بفهمیم چرا هوش مصنوعی در شرایط پیچیده اجتماعی رفتار خاصی رو نشون میده. 🤖🎲

منبع: arXiv NLP