محققان در پژوهش جدیدی با معرفی بنچمارک CogArena، به چالش کشیدن تواناییهای شناختی مدلهای زبانی بزرگ (LLM) پرداختند. نتایج این بررسی نشان میدهد که اگرچه این مدلها در تستهای مختلف نتایج مثبتی دارند، اما هنوز شواهد قطعی و پایداری از ساختارهای شناختی چندبعدی در آنها (مشابه آنچه در ذهن انسان میبینیم) وجود ندارد.
این تحقیق نشان میدهد که باید قبل از زدن برچسب «تواناییهای شناختی» به هوش مصنوعی، روشهای ارزیابی دقیقتر و علمیتری را دنبال کنیم. به نظر شما هوش مصنوعی تا چه حد میتواند تفکر انسانی را شبیهسازی کند؟ 🤔
منبع: arXiv AI



