محققان در یک پژوهش جدید، از یک روش مبتنی بر «مومنتوم» (Momentum-Based Reward) برای مدیریت چراغهای راهنمایی استفاده کردهاند. این مدل با استفاده از یادگیری تقویتی عمیق (DRL)، به جای تمرکز صرف بر ترافیک لحظهای، خودروها را تشویق به حرکت مداوم میکند.
نتیجه این کار چیست؟
✅ کاهش چشمگیر زمان انتظار در ترافیک
✅ کاهش آلایندگی (CO2) و مصرف سوخت
✅ پایداری بسیار بالاتر نسبت به سیستمهای قدیمی
این تحقیق گام مهمی در هوشمندسازی زیرساختهای شهری بدون نیاز به تغییر فیزیکی خیابانهاست. آینده شهرهای ما میتواند بسیار خلوتتر باشد! 🚗💨
منبع: arXiv Machine Learning
