محققان در یک پژوهش جدید، توانایی مدلهای پیشرفته هوش مصنوعی (VLM) مثل GPT-4o، جمینای و Qwen را در درک جزئیات و چیدمان قطعات لگو به چالش کشیدند.
نتایج این تحقیق نشان میدهد که با وجود پیشرفتهای چشمگیر، هوش مصنوعی هنوز در “درک فضایی دقیق” و تشخیص وضعیت قطعات در حین مونتاژ ضعیف عمل میکند. با اینکه در تشخیص اشیاء امتیاز بالایی کسب کردهاند، اما در وظایف پیچیدهتر مثل فهم مراحل ساخت، هنوز راه زیادی در پیش است.
این پروژه با معرفی بنچمارک LEGO Co-builder، به دنبال تقویت توانایی دستیارهای هوشمند برای کمک به کارهای فنی و ساختوساز در دنیای واقعی است. 🤖🛠
منبع: arXiv Computer Vision
