محققان در دستاورد جدیدی سیستم «ReinforceGen» را معرفی کردند که چالشهای طولانیمدت در رباتیک، بهویژه در انجام وظایف پیچیده و چندمرحلهای را هدف قرار داده است.
این سیستم با ترکیب یادگیری تقلیدی (Imitation Learning)، برنامهریزی حرکت و تقویت یادگیری (RL)، توانسته است نرخ موفقیت رباتها را در محیطهای آزمایشگاهی تا ۸۰ درصد افزایش دهد! 🦾
نکته هیجانانگیز اینجاست که این مدل با تنها ۱۰ نمونه دموی انسانی آموزش دیده و در نهایت با اصلاحات خودکار، توانسته عملکرد خود را تا ۸۹ درصد بهبود ببخشد. این یعنی رباتها در حال یادگیریِ بسیار سریعتر و دقیقتر برای تعامل با دنیای واقعی هستند.
جزئیات بیشتر و دموهای این پروژه را میتوانید در سایت پروژه ببینید.
منبع: arXiv AI
