محققان در پژوهشی جدید، رویکردی نوآورانه برای حل چالش کلاسیک «پاندول معکوس» ارائه دادهاند. آنها با استفاده از «نمای لیاپانوف» (Lyapunov Exponent) به عنوان یک پاداش متراکم در یادگیری تقویتی (RL)، موفق شدند نه تنها به حرکات نوسانی کلاسیک (پاندول کاپیتسا) دست یابند، بلکه سیستم را به شکلی هوشمندانه تثبیت کنند تا در حالت کاملاً عمودی باقی بماند.
این پیشرفت گامی مهم در افزایش دقت کنترل سیستمهای فیزیکی پیچیده با کمک هوش مصنوعی است.
منبع: arXiv Machine Learning
