محققان در مقاله جدیدی، روشی به نام PEARL را برای کنترل بهینه سیستمهای دینامیکی پیچیده معرفی کردهاند. بزرگترین چالش در یادگیری تقویتی (RL)، نیاز به تعامل بسیار زیاد با محیط است که باعث کندی و ناکارآمدی میشود.
روش جدید PEARL با تلفیق فیزیک و یادگیری تقویتی، از مشتقگیری خودکار برای محاسبه گرادیان سیاست استفاده میکند. نتیجه؟ کاهش چشمگیر نیاز به تعامل با محیط و پایداری بسیار بالاتر در کنترل سیستمهای پیچیده مثل جریانهای سیال ناپایدار. این گامی بزرگ برای کاربردیتر کردن هوش مصنوعی در مهندسی و علوم فیزیکی است! ⚙️🌐
منبع: arXiv Machine Learning
