محققان در یک تحقیق جدید با معرفی بنچمارک «DFAH-Bench»، به سراغ بررسی «رفتار عاملهای هوشمند» در تصمیمگیریهای مالی رفتهاند. نکته جالب اینجاست که حتی وقتی مدلهای هوش مصنوعی پیشرو، نتیجه نهایی مشابهی دارند، لزوماً از «مسیر منطقی» یکسانی برای رسیدن به آن استفاده نمیکنند!
این مطالعه نشان داد که بسیاری از مدلها با وجود رسیدن به توافق در تصمیمات، در فرآیند استدلال و استفاده از ابزارها با هم اختلاف دارند. این یافتهها برای توسعهدهندگان سیستمهای مالی فوقالعاده حیاتی است تا متوجه شوند آیا هوش مصنوعی واقعاً درست فکر میکند یا صرفاً خوششانس است! 🤖💸
منبع: arXiv AI
