دنیای هوش مصنوعی همچنان با چالش «استدلال منطقی» درگیر است. محققان به تازگی ابزار جدیدی به نام SATQuest را معرفی کردهاند که مانند یک «داور دقیق»، توانایی استدلال مدلهای زبانی (LLM) را به چالش میکشد.
این سیستم با استفاده از مسائل منطقی (SAT) و فرمتهای CNF، به جای تکیه بر حدس و گمان، به صورت علمی و چندبعدی، منطق مدلها را ارزیابی میکند. نتایج این بررسی نشان داده که حتی مدلهای قدرتمند هم در مواجهه با مسائل منطقی پیچیده دچار اشتباه میشوند، اما با استفاده از «آموزش تقویتی» (RL) مبتنی بر SATQuest میتوان این نقاط ضعف را به طرز چشمگیری بهبود بخشید.
این ابزار نه تنها به دانشمندان کمک میکند تا بفهمند مدلها چطور فکر میکنند، بلکه راهی برای تقویت قدرت استدلال واقعی در نسل بعدی هوش مصنوعی است. 🚀
منبع: arXiv AI
