محققان در مطالعهای جدید به بررسی این موضوع پرداختهاند که چرا مدلهای زبانی (LLMs) گاهی در تشخیص ظرافتهای فرهنگی دچار ضعف میشوند. این تیم با استفاده از تکنیکهای تفسیرپذیری مکانیکی، «هدهای توجه» (Attention Heads) خاصی را در لایههای میانی مدلها شناسایی کردهاند که مسئول پیوند دادن مفاهیم فرهنگی به هویتهای مرتبط هستند.
نکته جالب اینجاست که این مدلها دانش فرهنگی بسیار بیشتری از آنچه در عمل نمایش میدهند در اختیار دارند؛ یعنی مشکل اصلی نه در کمبود دانش، بلکه در «مسیریابی» اطلاعات است. با تقویت این بخشها، میتوان دقت مدلها را در درک تفاوتهای فرهنگی به شکلی چشمگیر افزایش داد بدون اینکه منطق کلی آنها تغییر کند. قدمی مهم برای ساخت هوش مصنوعیِ بافرهنگتر و دقیقتر! 🌍✨
منبع: arXiv AI
