مدلهای «بینایی-زبان-عمل» (VLA) که در دنیای واقعی و رباتیک استفاده میشوند، اغلب در برابر اختلالات محیطی آسیبپذیر هستند. محققان به تازگی فریمورک «RobustVLA» را معرفی کردهاند که با نگاهی جامع به ابعاد مختلف (دستورالعملها، محیط و حرکات)، مقاومت این مدلها را به شدت افزایش داده است.
نکته کلیدی اینجاست که این مدل نه تنها دقت بالاتری نسبت به مدلهای فعلی دارد، بلکه فرآیند استنتاج (Inference) را تا ۵۰ برابر سریعتر انجام میدهد! این یعنی قدمی بزرگ برای استقرار رباتهای هوشمندتر و قابلاطمینانتر در محیطهای واقعی. 🦾✨
منبع: arXiv AI
