آیا مدلهای زبانی (LLM) واقعاً آینده را پیشبینی میکنند یا فقط اطلاعات محرمانه از نتایجِ اتفاق افتاده را «لو» میدهند؟ محققان بهتازگی پروتکل جدیدی به نام HindsightBench معرفی کردهاند که بدون نیاز به دسترسی به دیتاسنتهای پیچیده، رفتارهای مدلهای هوش مصنوعی را در کارهای تصمیمگیری زمانی بررسی میکند.
نکته جالب اینجاست که این تحقیق نشان میدهد مدلهای نسل جدید (۲۰۲۶)، بهطور خودکار اطلاعاتی را از زمانهای آینده در دادههای آموزشی خود نشت میدهند که حتی از تقویم اعلامشده توسط شرکتهای سازنده هم جلوتر است! این ابزارِ کاربردی به محققان کمک میکند تا بدون هزینههای سنگین، شفافیت و صداقت مدلهای هوش مصنوعی را در تحلیلهای مالی و تاریخی بسنجند. 📉🤖
منبع: arXiv Machine Learning
