مدلهای VLA (بینایی-زبان-عمل) در حال تحول هستند! در پژوهش جدید، مدل CorridorVLA معرفی شده که با استفاده از «لنگرهای فضایی» (Spatial Anchors)، دقت و کنترل بازوهای رباتیک را به شکل چشمگیری افزایش میدهد.
این مدل با تعیین یک «دالان تلرانس» برای حرکات ربات، باعث میشود حرکات دقیقتر و اصلاحشدهتر انجام شوند. نتایج تستها روی بنچمارکهای مختلف مثل LIBERO-Plus نشاندهنده جهش عملکرد تا ۱۲ درصد نسبت به مدلهای قبلی است.
اگر در حوزه رباتیک و مدلهای بینایی-عمل فعال هستید، حتما کدها و چکپوینتهای این مدل جدید را در گیتهاب بررسی کنید! 🦾
منبع: arXiv AI
