یکی از چالشهای بزرگ در یادگیری تقویتشده (Reinforcement Learning)، یادگیری کارآمد از تصاویر با جزئیات بالاست. محققان به تازگی متد جدیدی معرفی کردهاند که با الهام از مدلهای زبانی و بینایی، از «پیشبینی ماسک» (Mask Prediction) به عنوان یک وظیفه کمکی استفاده میکند.
این روش به ایجنت کمک میکند تا با درک بهترِ دادههای محیطی و استفاده از ترنسفورمرها، بازنماییهای دقیقتری بسازد. نتیجه؟ بهبود چشمگیر در کارایی یادگیری (Sample Efficiency) و عملکرد بهتر در محیطهای کنترلی پیچیده نسبت به مدلهای فعلی! 🚀
منبع: arXiv AI
