تا به حال دقت کردید که مدلهای زبانی گاهی به پاسخ درست میرسند، اما مسیر رسیدن به آن (زنجیره استدلال) کاملاً اشتباه است؟ محققان برای حل این چالش، معیار جدیدی به نام «RAFS» معرفی کردهاند.
این ابزار بدون نیاز به پاسخهای مرجع، بررسی میکند که آیا استدلالِ پشتِ پاسخِ مدل، منطقی و قابلاعتماد است یا خیر. در واقع، RAFS به جای نگاه کردن به نتیجه نهایی، به کیفیتِ «فکر کردن» مدل در مسائل ریاضی میپردازد تا از خطاهای پنهان جلوگیری کند. قدمی بزرگ برای واقعیتر کردن هوش مصنوعی! 🚀
منبع: arXiv AI
