محققان در مطالعهای جدید به یک حقیقت نگرانکننده پی بردهاند: مدلهای زبانی بزرگ (LLM) فقط آینه رفتارهای انسانی نیستند، بلکه میتوانند خودشان به صورت خودجوش «تبعیضهای اجتماعی جدید» خلق کنند!
بر اساس این پژوهش، حتی زمانی که گروههای جمعیتی کاملاً ساختگی و بدون هیچ برتری ذاتی وجود داشته باشند، مدلها با استفاده از استراتژیهای کاوش و بهرهبرداری (Exploration-Exploitation)، یاد میگیرند که بر اساس تجربههای اولیه، قضاوتهای ناعادلانهای داشته باشند.
این یافتهها نشان میدهد که برای داشتن هوش مصنوعی منصفانه، فقط حذف دادههای تبعیضآمیز کافی نیست؛ بلکه باید معماری مدلها را بهگونهای تغییر دهیم که «تنوع در کاوش» را تشویق کنند تا شاهد شکلگیری تعصبات جدید نباشیم. 🧠⚖️
منبع: arXiv AI
