مدلهای بینایی-زبانی-کنشی (VLA) تا امروز بیشتر رفتاری واکنشی داشتند، اما با معرفی مدل جدید «FoMoVLA»، این روند در حال تغییر است! 🚀
محققان با ترکیب «پیشبینی بصری آینده» و «ردیابی مسیر حرکت»، فریمورکی ابداع کردهاند که به رباتها اجازه میدهد نه تنها مقصد (هدف)، بلکه چگونگی رسیدن به آن را هم با دقت بالا درک کنند. این مدل با پیشبینی وضعیت آینده و ترسیم مسیرهای حرکتی، عملکرد رباتها را در کارهای پیچیده به شکل چشمگیری بهبود داده است. ✨
آینده رباتیک در حال هوشمندتر شدن است؛ نظرتون در مورد این پیشرفت چیه؟
منبع: arXiv Computer Vision
