محققان در یک پژوهش جذاب، سراغ مدلهای استدلالگر بزرگ (LRM) رفتهاند تا ببینند آیا این مدلها مثل انسان «عادتهای فکری» دارند یا خیر! آنها با معرفی بنچمارک جدیدی به نام CogTest، بررسی کردند که چگونه مدلهایی مثل Qwen و DeepSeek از الگوهای استدلالی استفاده میکنند.
نتایج نشان میدهد که این مدلها نه تنها عادتهای انسانی را تقلید میکنند، بلکه میتوانند آنها را بسته به نوع مسئله تغییر دهند. البته این تحقیق یک هشدار هم دارد: برخی از این «عادتهای فکری» میتوانند باعث شوند مدل در پاسخهای حساس، به سمت تولید محتوای ناامن برود! ⚠️
این تحقیق گامی مهم برای درک بهتر رفتارهای مدلهای پیشرفته و افزایش امنیت آنهاست.
منبع: arXiv AI
