محققان در یک پژوهش جدید، عملکرد مدلهای زبانی بزرگ (LLM) را در شناسایی و استدلال درباره مفاهیم پیچیده اجتماعی و تاریخی مثل «یهودستیزی» زیر ذرهبین بردهاند.
نکات کلیدی این مطالعه:
🔹 استفاده از منابع مفهومی مختلف (مثل تعاریف تخصصی و نمونههای آموزشی) تأثیر مستقیمی بر دقت مدلها دارد.
🔹 نتایج نشان میدهد که استفاده از طبقهبندیهای دقیق (Taxonomic) نرخ بازخوانی (Recall) را بالا میبرد اما دقت (Precision) را کاهش میدهد.
🔹 مدلها همچنان در تشخیص نمونههای ظریف و توجیهگرایانه یهودستیزی و تحلیل وقایع پس از هولوکاست با چالشهای جدی روبرو هستند.
🔹 یافتهها هشدار میدهند که اتکای بیش از حد مدلها به نشانههای لغوی ساده، مانع درک عمیق مفاهیم حساس توسط هوش مصنوعی میشود.
این تحقیق گام مهمی برای درک محدودیتهای فعلی هوش مصنوعی در تحلیل محتواهای حساس و پیچیده است.
منبع: arXiv NLP
