دانشمندان حوزه هوش مصنوعی بهتازگی متد جدیدی به نام V-VLAPS معرفی کردند که به مدلهای «بینایی-زبان-عمل» (VLA) اجازه میدهد در کارهای رباتیک با هوشمندی بسیار بیشتری برنامهریزی کنند.
مشکل مدلهای فعلی این است که در مسیرهای طولانی یا شرایط جدید، تصمیمات اشتباه میگیرند. V-VLAPS با استفاده از یک «ارزیاب ارزش» (Value Head) به ربات کمک میکند تا قبل از انجام حرکت، نتایج احتمالی را بسنجد و بهترین مسیر را انتخاب کند. نتایج آزمایشها روی مجموعه LIBERO نشان داده که این روش دقت رباتها را در کارهای پیچیده به شکل چشمگیری افزایش میدهد.
این یعنی حرکت به سمت رباتهایی که نه تنها میبینند و میشنوند، بلکه مثل ما برای کارهایشان «فکر» و «برنامهریزی» میکنند! 🦾✨
منبع: arXiv AI
