دانشمندان در یک پژوهش جدید به سراغ سنجش توانایی مدلهای زبانی بزرگ (LLM) در حل مسائل منطقی (Constraint Reasoning) رفتهاند. نتیجه جالب اینجاست که دشواری ریاضی یک مسئله برای کامپیوتر، لزوماً به این معنی نیست که مدل هوش مصنوعی هم در حل آن با چالش بیشتری مواجه میشود!
این تحقیق نشان میدهد که مدلها گاهی در مواجهه با مسائل بسیار سادهتر، «گیج» میشوند یا در مسائل پیچیده، عملکرد غیرقابل پیشبینی دارند. در واقع، درک ما از «سختی» برای مدلهای هوش مصنوعی هنوز جای کار زیادی دارد و شاید مدلهای ما بیشتر از اینکه منطقی باشند، به ساختار ظاهری سوال حساس هستند. 🤖💡
منبع: arXiv AI
