🔍 استدلال منطقی در LLMها؛ آیا هوش مصنوعی واقعاً منطق دارد؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

دانشمندان در یک پژوهش جدید به سراغ سنجش توانایی مدل‌های زبانی بزرگ (LLM) در حل مسائل منطقی (Constraint Reasoning) رفته‌اند. نتیجه جالب اینجاست که دشواری ریاضی یک مسئله برای کامپیوتر، لزوماً به این معنی نیست که مدل هوش مصنوعی هم در حل آن با چالش بیشتری مواجه می‌شود!

این تحقیق نشان می‌دهد که مدل‌ها گاهی در مواجهه با مسائل بسیار ساده‌تر، «گیج» می‌شوند یا در مسائل پیچیده، عملکرد غیرقابل پیش‌بینی دارند. در واقع، درک ما از «سختی» برای مدل‌های هوش مصنوعی هنوز جای کار زیادی دارد و شاید مدل‌های ما بیشتر از اینکه منطقی باشند، به ساختار ظاهری سوال حساس هستند. 🤖💡

منبع: arXiv AI