🧠 حل معمای استدلال مدل‌های زبانی: فراتر از تقلب در Chain-of-Thought

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

آیا هوش مصنوعی واقعاً منطقی فکر می‌کند یا فقط جواب را حفظ کرده است؟ محققان در مطالعه‌ای جدید به بررسی پدیده‌ای به نام «عقلانی‌سازی پس‌رویدادی» پرداخته‌اند.

مشکل اینجاست که وقتی مدل‌ها هنگام تولید زنجیره استدلال (Chain-of-Thought) به جواب دسترسی دارند، به جای «استدلال کردن»، صرفاً مسیر را به سمت جوابِ از پیش دانسته تغییر می‌دهند. این مقاله روش جدیدی به نام SSR (استدلال اسکلتی ساختاریافته) را معرفی می‌کند که با حذف وابستگی مستقیم به جواب نهایی، مدل را مجبور می‌کند به جای تقلب، واقعاً استدلال کند.

این پیشرفت می‌تواند دقت و قابلیت اطمینان مدل‌های زبانی در مسائل پیچیده منطقی را به شدت افزایش دهد! 🚀

منبع: arXiv NLP