محققان در مطالعهای جدید، روشی نوآورانه به نام «AnchorRefine» برای مدلهای «بینایی-زبان-عمل» (VLA) ارائه دادهاند. مشکل مدلهای فعلی این بود که نمیتوانستند بین حرکتهای بزرگِ کلی و اصلاحاتِ دقیقِ جزئی تعادل برقرار کنند.
این چارچوب جدید، برنامهریزی حرکتی را به دو بخش تقسیم میکند: یک مسیر کلی (Anchor) و یک ماژول اصلاحکننده (Refinement) برای دقتهای میلیمتری. نتیجه؟ افزایش ۱۸ درصدی موفقیت در کارهای واقعی رباتیک! این یعنی رباتها حالا با هوشمندی بیشتری میتوانند اشیا را لمس و جابهجا کنند. 🚀✨
منبع: arXiv AI
