📍 معرفی بنچمارک MapTab: چالشی جدید برای سنجش قدرت استدلال مدل‌های هوش مصنوعی!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در پژوهشی جدید، بنچمارک هوشمندانه‌ای به نام MapTab را معرفی کرده‌اند که توانایی مدل‌های چندوجهی (MLLM) را در مسیریابی و استدلال‌های پیچیده (چند معیاره) به چالش می‌کشد. 🗺️

این بنچمارک با استفاده از نقشه‌های مترو و جاذبه‌های گردشگری در ده‌ها کشور، مدل‌ها را در فاکتورهایی مثل «زمان»، «قیمت»، «راحتی» و «قابلیت اطمینان» ارزیابی می‌کند. نتایج نشان می‌دهد که مدل‌های فعلی هنوز در ترکیب اطلاعات بصری (نقشه) با داده‌های متنی (جداول) دچار چالش‌های جدی هستند. این ابزار گام بزرگی برای رسیدن به هوش مصنوعی عمومی (AGI) و بهبود درکِ محیطی مدل‌هاست. 🚀🧠

منبع: arXiv Machine Learning