محققان در یک دستاورد تازه، فریمورک «MEMENTO» را برای بهبود سیاستهای رباتیک معرفی کردهاند. این روش با الهام از تکامل و حافظه، به رباتها کمک میکند تا وظایف طولانی و پیچیده (مثل جابهجایی اشیاء در محیطهای خانگی یا صنعتی) را با بازنویسی و بهینهسازی کدهای کنترلی خود، بسیار دقیقتر انجام دهند.
در واقع MEMENTO با ترکیب مدلهای زبانی بزرگ (LLM) و بازخوردهای عملکردی، به ربات اجازه میدهد از تجربههای قبلی درس بگیرد و خودش را اصلاح کند. این گامی بزرگ برای هوشمندتر شدن ایجنتهای فیزیکی در انجام وظایف واقعی است! 🚀
منبع: arXiv Machine Learning
