🔍 چالش پنهان هوش مصنوعی: وقتی کلیشه‌ها در لایه‌های مدل پنهان می‌شوند!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

تحقیقات جدید در بنچمارک «ImplicitBBQ» نشان می‌دهد که مدل‌های زبانی بزرگ، حتی وقتی سعی می‌کنند خنثی باشند، همچنان دچار سوگیری‌های پنهان (Implicit Bias) هستند. برخلاف سوگیری‌های آشکار، این مدل‌ها در مواجهه با نشانه‌های غیرمستقیم (مثل سن، مذهب، طبقه اجتماعی و نژاد) عملکرد ضعیفی دارند.

نکته تامل‌برانگیز این است که در مدل‌های متن‌باز، سوگیری‌های پنهان ۶ برابر بیشتر از سوگیری‌های آشکار است و متاسفانه راهکارهای فعلی مثل «Prompting» یا «Safety Training» هنوز نتوانسته‌اند این شکاف را به‌طور کامل پر کنند. این پژوهش زنگ خطری برای توسعه‌دهندگان است که دقت بیشتری روی داده‌های آموزشی داشته باشند. نظر شما چیست؟ آیا هوش مصنوعی بالاخره می‌تواند از قضاوت‌های انسانی عبور کند؟

منبع: arXiv AI