تحقیقات جدید در بنچمارک «ImplicitBBQ» نشان میدهد که مدلهای زبانی بزرگ، حتی وقتی سعی میکنند خنثی باشند، همچنان دچار سوگیریهای پنهان (Implicit Bias) هستند. برخلاف سوگیریهای آشکار، این مدلها در مواجهه با نشانههای غیرمستقیم (مثل سن، مذهب، طبقه اجتماعی و نژاد) عملکرد ضعیفی دارند.
نکته تاملبرانگیز این است که در مدلهای متنباز، سوگیریهای پنهان ۶ برابر بیشتر از سوگیریهای آشکار است و متاسفانه راهکارهای فعلی مثل «Prompting» یا «Safety Training» هنوز نتوانستهاند این شکاف را بهطور کامل پر کنند. این پژوهش زنگ خطری برای توسعهدهندگان است که دقت بیشتری روی دادههای آموزشی داشته باشند. نظر شما چیست؟ آیا هوش مصنوعی بالاخره میتواند از قضاوتهای انسانی عبور کند؟
منبع: arXiv AI
