محققان در پژوهشی جدید، پدیدهای به نام «همکشش زمینهای» (Contextual Entrainment) را در مدلهای چندوجهی (VLM) بررسی کردند. این مدلها گاهی به جای تمرکز بر واقعیت، تحت تأثیر اطلاعات اضافی و غیرمرتبط در متن یا تصویر قرار میگیرند.
برای مقابله با این مشکل، ابزار جدیدی به نام «ENTRAP-VL» معرفی شده که با ۱۵۰۰ نمونه دقیق، به محققان کمک میکند تا میزان خطای این مدلها در ترکیب دادههای متنی و بصری را بسنجند و درک بهتری از چگونگی استدلال آنها به دست آورند.
منبع: arXiv NLP
