🔍 چالش جدید در هوش مصنوعی: مدل‌های بینایی-زبانی چقدر تحت تأثیر «زمینه» هستند؟ 🖼️🤖

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در پژوهشی جدید، پدیده‌ای به نام «هم‌کشش زمینه‌ای» (Contextual Entrainment) را در مدل‌های چندوجهی (VLM) بررسی کردند. این مدل‌ها گاهی به جای تمرکز بر واقعیت، تحت تأثیر اطلاعات اضافی و غیرمرتبط در متن یا تصویر قرار می‌گیرند.

برای مقابله با این مشکل، ابزار جدیدی به نام «ENTRAP-VL» معرفی شده که با ۱۵۰۰ نمونه دقیق، به محققان کمک می‌کند تا میزان خطای این مدل‌ها در ترکیب داده‌های متنی و بصری را بسنجند و درک بهتری از چگونگی استدلال آن‌ها به دست آورند.

منبع: arXiv NLP