محققان بهتازگی از بنچمارک جدیدی به نام IDEAL-Bench رونمایی کردند که هدفش ارزیابی دقیق توانایی مدلهای بینایی-زبانی (VLM) در درک چیدمان سهبعدی محیطهای داخلی است. 🏠
نکته جالب اینجاست که مدلهای کنونی هوش مصنوعی در توصیف صحنهها عالی هستند، اما وقتی نوبت به «اندازهگیری» دقیق فواصل و هندسه اشیاء میرسد، هنوز ضعف دارند و نمرات چندان بالایی کسب نمیکنند. این بنچمارک کمک میکند تا بفهمیم مدلها چطور میتوانند از توصیفات ساده فراتر رفته و دیدی مهندسیتر به محیط پیرامون پیدا کنند. 📏📐
آیندهی هوش مصنوعی در درک واقعی فضا، در حال دقیقتر شدن است!
منبع: arXiv Computer Vision
