تا به حال فکر کردهاید که چرا ارزیابی مدلهای هوش مصنوعی در تحلیلهای مالی با چالش مواجه است؟ پاسخ ساده است: در دنیای واقعیِ اقتصاد، همیشه یک پاسخ «درست» و مطلق وجود ندارد!
محققان ابزار جدیدی به نام GAUGE را معرفی کردهاند که به جای مقایسه خروجی هوش مصنوعی با یک پاسخ ثابت، عملکرد مدل را بر اساس «روشهای رایج تحلیلگران حرفهای» ارزیابی میکند.
این بنچمارک با بررسی بیش از ۱۰۰۰ مدل تحلیلی، به ما میگوید که مدلهای هوش مصنوعی فعلی در حوزه مالی، عملکردی بهتر از دانشجویان دارند، اما هنوز تا سطح دانشِ تحلیلگران ارشد فاصله زیادی دارند. این گامی بزرگ برای هوشمندتر کردن ابزارهای مالیِ مبتنی بر AI است. 📈💡
منبع: arXiv AI
