تا به حال فکر کردید چطور رباتها میتوانند محیط اطرافشان را درک کنند و همزمان دستورات ما را اجرا کنند؟ مشکل مدلهای فعلی این است که بین پیشبینی ویدئویی (دیدن محیط) و اجرای عمل (حرکت ربات) هماهنگی دقیقی ندارند.
محققان در مقاله جدیدی مدل «DeVA» را معرفی کردند که این دو بخش را از هم جدا کرده و با استفاده از «هدایت فیزیکی» (مانند درک عمق و موانع)، به ربات کمک میکند با دادههای کمتر، خیلی سریعتر و دقیقتر یاد بگیرد. این یعنی رباتهایی که در دنیای واقعی، حرکات هوشمندانهتر و قابلاعتمادتری دارند. 🦾✨
منبع: arXiv Computer Vision
