🧠 رمزگشایی از پیوندهای فرهنگی در مدل‌های زبانی؛ هوش مصنوعی چگونه جهان را می‌بیند؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان در مطالعه‌ای جدید به بررسی این موضوع پرداخته‌اند که چرا مدل‌های زبانی (LLMs) گاهی در تشخیص ظرافت‌های فرهنگی دچار ضعف می‌شوند. این تیم با استفاده از تکنیک‌های تفسیرپذیری مکانیکی، «هدهای توجه» (Attention Heads) خاصی را در لایه‌های میانی مدل‌ها شناسایی کرده‌اند که مسئول پیوند دادن مفاهیم فرهنگی به هویت‌های مرتبط هستند.

نکته جالب اینجاست که این مدل‌ها دانش فرهنگی بسیار بیشتری از آنچه در عمل نمایش می‌دهند در اختیار دارند؛ یعنی مشکل اصلی نه در کمبود دانش، بلکه در «مسیریابی» اطلاعات است. با تقویت این بخش‌ها، می‌توان دقت مدل‌ها را در درک تفاوت‌های فرهنگی به شکلی چشمگیر افزایش داد بدون اینکه منطق کلی آن‌ها تغییر کند. قدمی مهم برای ساخت هوش مصنوعیِ بافرهنگ‌تر و دقیق‌تر! 🌍✨

منبع: arXiv AI