با رشد روزافزون مدلهای زبانی (LLM) و نفوذ آنها به زندگی روزمره، یک سوال مهم مطرح شده است: آیا این مدلها میتوانند سوگیریهای اقتدارگرایانه داشته باشند؟
محققان به تازگی بنچمارک جدیدی به نام AuAu را معرفی کردهاند که به طور تخصصی رفتارهای اقتدارگرایانه، پرخاشگری و تمایل به اطاعت را در مدلهای هوش مصنوعی (از جمله مدلهای اروپایی، آمریکایی، چینی و روسی) ارزیابی میکند.
نتایج این تحقیق نشان میدهد که بسیاری از مدلها در تستهای روانسنجی به راحتی تحت تاثیر سیستمپرامپتهای اقتدارگرا قرار میگیرند و نیاز به نظارت و اصلاح در این حوزه به شدت احساس میشود. این یک گام بزرگ برای اطمینان از توسعه «هوش مصنوعی اخلاقمدار» در آینده است. 🤖⚖️
منبع: arXiv AI
