محققان در پژوهش جدیدی، الگوریتم نوآورانهای به نام Reinformed Dreamer را معرفی کردهاند که دنیای «یادگیری تقویتی مدلمحور» (Model-based RL) را متحول میکند.
این مدل با بهرهگیری از «هدایت نهان» (Latent Guidance) و با استفاده از اطلاعات جانبی (Privileged Information)، یادگیری و بازنماییهای دقیقتری را نسبت به مدلهای قبلی مثل Dreamer ارائه میدهد. این دستاورد به مدلها کمک میکند تا در محیطهایی با اطلاعات ناقص، عملکرد بسیار باثباتتر و کارآمدتری داشته باشند. ✨
منبع: arXiv Machine Learning
