محققان با معرفی بنچمارک جدیدی به نام CCBENCH، به چالش بزرگی در دنیای مدلهای زبانی (LLM) پرداختهاند: «صلاحیت فرهنگی».
نتایج این تحقیق نشان میدهد که هوش مصنوعی در درک ارزشهای فرهنگی نهفته در گفتوگوها، بهویژه در حوزههای حساسی مثل سلامت، هنوز مسیر زیادی در پیش دارد. جالب و البته نگرانکننده است که بدانید عملکرد مدلها در محیطهای فرهنگی خاص (مانند بافت فرهنگی افغانستان) بسیار پایین گزارش شده که نشاندهنده سوگیریهای عمیق در آموزش این مدلهاست.
به نظر شما، آیا روزی میرسد که هوش مصنوعی واقعاً بتواند تفاوتهای ظریف فرهنگی جوامع مختلف را درک کند؟
منبع: arXiv AI
