مدلهای زبانی چندوجهی (MLLM) روز به روز در حال پیشرفت هستند، اما همچنان در ساخت رابطهای کاربری پیچیده و چندمنظوره با چالش روبهرواند. محققان به تازگی بنچمارک جدیدی به نام MV-Bench را معرفی کردهاند که به طور اختصاصی برای سنجش توانایی این مدلها در درک دادهها و ایجاد رابطهای تعاملی و یکپارچه طراحی شده است. 🛠️
این بنچمارک با استفاده از بیش از ۱۰۰۰ نمونه واقعی از ورکبوکهای Tableau، توانایی مدلها را در رعایت جزئیات بصری و منطق تعاملی به چالش میکشد. گامی مهم برای هوشمندتر کردن ابزارهای تولید کد و طراحی خودکار! ✨
نویسی
منبع: arXiv Computer Vision
