محققان در پژوهشی جدید، راهکار نوآورانهای برای مدلهای «بینایی-زبان-عمل» (VLA) ارائه کردهاند تا رباتها بتوانند اجسام را در محیطهای پیچیده، حتی با تغییر زاویه یا پوشیدگی، بهتر درک کنند.
این روش با استفاده از یک معلم سهبعدی (SAM3D)، به ربات کمک میکند تا بدون نیاز به تجهیزات پیچیده در زمان اجرا، درک عمیقتری از اجسام داشته باشد. نتایج آزمایشها در محیطهای شبیهسازیشده و واقعی نشاندهنده بهبود چشمگیر در انجام وظایف چندمرحلهای است. این یک گام مهم دیگر به سوی رباتهای خانگی و صنعتی هوشمندتر است! 🦾✨
منبع: arXiv AI
