محققان ابزار جدیدی به نام InvestPhilBench را طراحی کردهاند که بهطور اختصاصی برای سنجش توانایی مدلهای زبانی (LLM) در تحلیلهای تخصصی سرمایهگذاری توسعه یافته است.
این بنچمارک به جای تستهای عمومی، «تفکر رویهای» مدلها را در برخورد با فلسفههای سرمایهگذاریِ متخصصان تحلیل میکند. با این ابزار میتوان فهمید که آیا مدلهای هوش مصنوعی واقعاً مثل یک تحلیلگر خبره فکر میکنند یا فقط از روی حدسیات پاسخ میدهند. این قدم بزرگی برای کاربردیتر کردن هوش مصنوعی در بازارهای مالی است! 📈💰
منبع: arXiv Machine Learning
