محققان در مقالهای جدید، متد انقلابی «SymStep» را معرفی کردند که نقطه ضعف بزرگ مدلهای زبانی (LLM) در حل مسائل منطقی و پازلهای دشوار را هدف گرفته است.
مشکل کجاست؟ مدلهای فعلی هنگام استدلال مرحلهبهمرحله (CoT)، در مسائل منطقیِ دارای محدودیتهای زیاد دچار خطا شده و این خطاها را تا انتها ادامه میدهند.
راهکار SymStep چیست؟
✅ مدل در هر مرحله فقط یک ادعای منطقی مطرح میکند.
✅ یک لایه «اعتبارسنجی نمادین» بلافاصله ادعا را با حقایق قبلی چک میکند.
✅ اگر تناقضی وجود داشته باشد، بلافاصله اصلاح میشود.
نتیجه خیرهکننده: این سیستم در بنچمارکهای سخت منطقی، عملکردی تا ۹۷٪ (در مقایسه با ۰٪ مدلهای معمولی) ثبت کرده است! این یعنی هوش مصنوعی در حال یادگیری تفکر دقیقتر و بدون خطای محاسباتی است.
منبع: arXiv AI
