محققان در دستاورد جدیدی به نام «GeoMoLa»، روشی خلاقانه برای آموزش رباتها معرفی کردهاند. برخلاف روشهای سنتی که به بازسازی تصاویر وابسته بودند، این مدل با پیشبینی تغییرات سهبعدی ابرها (Point Clouds) در طول زمان، حرکات فیزیکی را درک میکند.
این یعنی رباتها دیگر فقط «ظاهر» صحنه را نمیبینند، بلکه «فیزیک حرکت» را درک میکنند! این مدل توانسته در محیطهای شلوغ و واقعی، بدون نیاز به دیدگاههای چندگانه و تنها با یک دوربین RGB-D، به عملکردی خیرهکننده دست پیدا کند. این قدم بزرگی برای رباتیک هوشمند و تعامل دقیقتر با دنیای واقعی است. 🦾⚙️
منبع: arXiv AI
