مدلهای بینایی-زبانی-عملگر (VLA) که مغز متفکر رباتهای مدرن هستند، گاهی به خاطر نوع نگارش دستورات انسانی، گیج میشوند! 😵💫
محققان در مقاله جدیدی روشی به نام «VLA Grounder» معرفی کردهاند که به جای تغییر ساختار سنگین مدل، روی «فضای دستورات» تمرکز دارد. این مدل با استفاده از یادگیری تقویتی (RL)، یاد میگیرد که چطور دستورات انسانی را به زبانِ قابلفهمتری برای ربات ترجمه کند تا عملیات پیچیده با دقت بسیار بالاتری انجام شود. 🛠️✨
به زبان ساده: به جای آموزش مجدد ربات، به او یاد میدهیم چطور بهتر گوش کند!
منبع: arXiv AI
