محققان در مطالعهای جدید به یک چالش بنیادی در مدلهای زبانی بزرگ (LLMs) پی بردهاند که آن را «کوری الگوریتمی» نامیدهاند! 🧠
ماجرا چیست؟
این تحقیق نشان میدهد که اگرچه LLMها دانش گستردهای دارند، اما در درک و پیشبینی فرآیندهای محاسباتی به شدت ضعیف عمل میکنند. در واقع، اکثر مدلهای پیشرو در این آزمایشها، حتی از حدس تصادفی هم عملکرد ضعیفتری داشتند و به جای استدلال منطقی، صرفاً به «حفظ کردن» بنچمارکها روی آوردهاند.
نتیجهگیری مهم:
این یافتهها فاصله عمیق بین «دانشِ نظری» مدلها و «تواناییِ حل مسائل محاسباتی» آنها را نشان میدهد و زنگ خطری است برای کسانی که برای تصمیمگیریهای حساس، به هوش مصنوعی تکیه میکنند.
به نظر شما، آیا این ضعف با مدلهای آینده و روشهای آموزش فعلی قابل حل است یا یک بنبست ذاتی در معماری ترنسفورمرهاست؟ 🤔
منبع: arXiv NLP
