محققان به تازگی چالش جدیدی را شناسایی کردهاند که نشان میدهد مدلهای بینایی-زبانی (VLM) به راحتی توسط «نمودارهای دستکاریشده» فریب میخورند! ⚠️
در این پژوهش، بنچمارک جدیدی به نام VisDeception معرفی شده که ۱۶۰۰ نمودار مختلف (از نمودارهای تغییریافته تا رنگهای گمراهکننده) را شامل میشود. نتایج نشان میدهد حتی پیشرفتهترین مدلها هم هنگام مواجهه با این فریبهای بصری، تحلیلهای اشتباهی ارائه میدهند.
تیم تحقیق برای حل این مشکل، یک فریمورک چندعامله (Multi-agent) پیشنهاد داده که به مدلها کمک میکند تحلیلهای خود را بر پایه دادههای ساختاریافته استوار کنند تا کمتر فریب بخورند. این قدم بزرگی برای افزایش دقت و اعتماد در تحلیل دادههای پیچیده توسط هوش مصنوعی است. 🤖✨
منبع: arXiv AI
