محققان در مطالعه جدیدی به چالش جالبی در مدلهای زبانی (LLMs) پرداختهاند: سوگیری مدلها در درک کلمات چندمعنایی در زبان «بنگلا». برای مثال، کلمهای مثل «مایا» که هم به عنوان یک اسم خاص و هم یک مفهوم احساسی استفاده میشود، اغلب توسط مدلها به اشتباه تفسیر میشود.
نکات کلیدی این پژوهش:
✅ شناسایی سوگیری شدید مدلها به سمت معنای رایجتر و نادیده گرفتن اسامی خاص.
✅ معرفی مجموعه داده جدید CEH برای آموزش بهتر مدلها با مفاهیم فرهنگی.
✅ اثبات اینکه «Chain-of-Thought» و آموزش مبتنی بر استدلال میتواند دقت مدلهای کوچک را تا حد چشمگیری افزایش دهد.
این دستاورد نشان میدهد که برای داشتن هوش مصنوعی واقعاً جهانی، «دانش فرهنگی» به اندازه قدرت پردازش اهمیت دارد!
منبع: arXiv NLP
