🧠 آیا هوش مصنوعی در ریاضیات واقعاً «می‌فهمد» یا فقط حفظ می‌کند؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در یک مطالعه جدید به سراغ چالش «استدلال ریاضی» در مدل‌های زبانی بزرگ (LLM) رفته‌اند. نتایج نشان می‌دهد که این مدل‌ها به‌شدت نسبت به نحوه بیان سوال (مثلاً تغییر از صورت مسئله داستانی به معادله نمادین) حساس هستند و با تغییرات جزئی در متن، ممکن است دچار خطا شوند!

نکته جالب اینجاست که حتی وقتی مدل‌ها را مجبور می‌کنیم با نوشتن کد پایتون به پاسخ برسند (اجرای استدلال)، باز هم تضمینی برای حل دقیق مسائل وجود ندارد و خطاها فقط از شکلی به شکل دیگر تغییر می‌کنند. این تحقیق نشان می‌دهد که راه زیادی تا رسیدن به «استدلال منطقیِ پایدار» در هوش مصنوعی باقی مانده است. 📉🤖

منبع: arXiv AI