محققان در یک پژوهش جدید، از متد «TSRL» برای حل چالشهای لجستیک شهری رونمایی کردند. این سیستم که از یادگیری تقویتی دو-مقیاسی (Two TimeScale Reinforcement Learning) بهره میبرد، به پهپادها کمک میکند تا در محیطهای پویا و تحت شرایطی مثل بادهای شدید، همزمان کارایی انرژی و سرعت توزیع کالا را به حداکثر برسانند.
این فریمورک تصمیمگیری را به دو سطح تقسیم میکند: سطح کلان برای مدیریت وظایف و سطح خرد برای کنترل دقیق سرعت. نتایج آزمایشها نشان داده که این روش میتواند بهرهوری عملیاتی پهپادها را تا ۴۶٪ افزایش دهد! 📦✨
منبع: arXiv Machine Learning
