محققان در پژوهشی جدید، بنچمارک هوشمندانهای به نام MapTab را معرفی کردهاند که توانایی مدلهای چندوجهی (MLLM) را در مسیریابی و استدلالهای پیچیده (چند معیاره) به چالش میکشد. 🗺️
این بنچمارک با استفاده از نقشههای مترو و جاذبههای گردشگری در دهها کشور، مدلها را در فاکتورهایی مثل «زمان»، «قیمت»، «راحتی» و «قابلیت اطمینان» ارزیابی میکند. نتایج نشان میدهد که مدلهای فعلی هنوز در ترکیب اطلاعات بصری (نقشه) با دادههای متنی (جداول) دچار چالشهای جدی هستند. این ابزار گام بزرگی برای رسیدن به هوش مصنوعی عمومی (AGI) و بهبود درکِ محیطی مدلهاست. 🚀🧠
منبع: arXiv Machine Learning
