محققان به تازگی بنچمارک جدیدی به نام «Polistemics» معرفی کردهاند تا عملکرد مدلهای زبانی بزرگ (LLM) را در نقش واسط اطلاعات سیاسی تحلیل کنند. این تحقیق که بر اساس انتخابات آلمان و هلند انجام شده، نشان میدهد که اگرچه هوش مصنوعی در شرایطی با اطلاعات شفاف عملکرد خوبی دارد، اما در مواجهه با اخبار مبهم یا متناقض دچار خطاهای سیستماتیک میشود.
این مطالعه تأکید میکند که مدلهای فعلی هنوز تا رسیدن به «تواضع معرفتی» (Epistemic Modesty) فاصله دارند و گاهی سوگیریهای حزبی یا تغییر لحن محتوا، خروجی آنها را تحت تأثیر قرار میدهد. آیا روزی هوش مصنوعی میتواند به عنوان یک ناظر بیطرف سیاسی عمل کند؟ 🤔
منبع: arXiv NLP
