آیا هوش مصنوعی میتواند گزارشهای مالی قابل اعتماد و قانونی تولید کند؟ محققان بهتازگی مقیاس جدیدی به نام CM-LRS معرفی کردهاند که دقت مدلهای زبانی بزرگ (LLM) را در محیطهای حساس مالی بررسی میکند.
برخلاف بنچمارکهای معمولی، این معیار جدید بررسی میکند که خروجیهای مدل تا چه حد برای نهادهای نظارتی و معاملهگران «قابل استناد» است. این ارزیابی بر اساس ۷ فاکتور کلیدی از جمله دقت در آمار، قابلیت ردیابی منابع و قابلیت حسابرسی انجام میشود.
این پیشرفت گام بزرگی برای استفاده امن و حرفهای از هوش مصنوعی در تحلیلهای پیچیده بانکی و سرمایهگذاری است. 📈
منبع: arXiv NLP
