محققان تکنیک جدیدی برای مدلهای بینایی-زبانی-کنشی (VLA) معرفی کردهاند که به رباتها اجازه میدهد مثل انسانها فکر کنند. این مدل با ارزیابی پیچیدگی شرایط، تصمیم میگیرد که:
✅ بلافاصله دستور را اجرا کند (Act)
✅ در شرایط پیچیده کمی تأمل و استدلال کند (Think)
✅ یا اگر شرایط خطرناک یا نامفهوم است، کلاً متوقف شود (Abstain)!
این روش که روی مدلهایی مثل SmolVLA تست شده، نه تنها سرعت پاسخدهی رباتها را بالا میبرد، بلکه از بروز اشتباهات فاجعهبار در شرایط پیشبینینشده جلوگیری میکند. گامی بزرگ برای تعامل امنتر رباتها در دنیای واقعی! 🤖✨
منبع: arXiv Computer Vision
