یک تحقیق جدید و جذاب در حوزه شبیهسازی اجتماعی، دست روی نکته مهمی گذاشته است: مدلهای زبانی بزرگ (LLM) ممکن است پاسخهای نهایی مشابه انسانها بدهند، اما آیا منطق پشت این تصمیمگیری هم با انسان یکی است؟
محققان با استفاده از یک تست تحلیل رفتار (در حوزه خرید ضدآفتاب)، متوجه شدند که اگرچه هوش مصنوعی میتواند ظاهرِ استدلال را حفظ کند، اما در واقعیت، منطقِ پشت تصمیمگیریاش اغلب با مسیر فکری انسانها تفاوت دارد. این یعنی برای استفاده از AI به عنوان «شبیهساز رفتارهای انسانی»، هنوز راه درازی باقی است.
این مقاله ابزار جدیدی برای ارزیابی این “استدلالهای پنهان” معرفی کرده تا بفهمیم مدلها واقعاً درک میکنند یا فقط تقلید میکنند! 🕵️♂️🔍
منبع: arXiv AI
