محققان روش جدیدی به نام MPPO (Mixed Proximal Policy Optimization) ابداع کردهاند که انقلابی در رفتار ایجنتهای هوش مصنوعی در بازیها ایجاد میکند.
مشکل روشهای فعلی این بود که یا ایجنتها فقط روی «برنده شدن» تمرکز میکردند (و خستهکننده میشدند) یا اگر خلاق بودند، دقت و مهارت لازم را نداشتند. روش MPPO به ایجنتها کمک میکند که هم در سطح حرفهای بازی کنند و هم سبکهای بازی متنوع و انسانی داشته باشند. این یعنی تجربهای جذابتر و واقعیتر در بازیهای ویدئویی! 🚀
منبع: arXiv AI
