🗳️ هوش مصنوعی در نقش داور انتخاباتی؛ آیا می‌توان به LLMها اعتماد کرد؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان به تازگی بنچمارک جدیدی به نام «Polistemics» معرفی کرده‌اند تا عملکرد مدل‌های زبانی بزرگ (LLM) را در نقش واسط اطلاعات سیاسی تحلیل کنند. این تحقیق که بر اساس انتخابات آلمان و هلند انجام شده، نشان می‌دهد که اگرچه هوش مصنوعی در شرایطی با اطلاعات شفاف عملکرد خوبی دارد، اما در مواجهه با اخبار مبهم یا متناقض دچار خطاهای سیستماتیک می‌شود.

این مطالعه تأکید می‌کند که مدل‌های فعلی هنوز تا رسیدن به «تواضع معرفتی» (Epistemic Modesty) فاصله دارند و گاهی سوگیری‌های حزبی یا تغییر لحن محتوا، خروجی آن‌ها را تحت تأثیر قرار می‌دهد. آیا روزی هوش مصنوعی می‌تواند به عنوان یک ناظر بی‌طرف سیاسی عمل کند؟ 🤔

منبع: arXiv NLP