محققان در یک پژوهش جدید، راهکاری برای افزایش سرعت آموزش مدلهای «بینایی-زبان-عمل» (VLA) ارائه دادهاند. چالش اصلی همواره این بوده که آموزش آنلاین کیفیت بالاتری دارد اما پرهزینه است، در حالی که آموزش آفلاین سریعتر اما گاهی ضعیفتر عمل میکند.
در این متد جدید، با استفاده از «نظارت آفلاین» (Offline Supervision) در کنار یادگیری تقویتی، مدلها توانستهاند با همان کیفیت بالا، با نصف بودجه و زمانِ معمول آموزش ببینند! این یک گام بزرگ برای توسعه مدلهای رباتیک و هوش مصنوعی است که در دنیای واقعی و شرایط خارج از توزیع (OOD) عملکرد بهتری داشته باشند.
💡 این یعنی پیشرفت در دقت و سرعت، بدون قربانی کردن کارایی مدلهای هوشمند.
منبع: arXiv Machine Learning
