محققان در پژوهشی جدید، فریمورک نوآورانه ADWM (Autoregressive Diffusion World Model) را معرفی کردهاند که تحولی در ارزیابی ایجنتهای هوش مصنوعی ایجاد میکند. 🤖
تا امروز، ارزیابی مدلهای زبانی (LLM) در محیطهای تعاملی بسیار هزینهبر و ریسکپذیر بود، چون نیاز به اجرای آنلاین در محیط واقعی داشت. حالا با ADWM، میتوان عملکرد ایجنتها را تنها از طریق دادههای از پیش جمعآوری شده و با استفاده از «مدلهای دنیای نفوذی» (Diffusion World Models) شبیهسازی کرد.
ویژگی کلیدی این مدل، جلوگیری از خطاهای تجمعی در شبیهسازی است؛ به این صورت که مدل، هر مرحله را به عنوان یک فرآیند مستقل نویززدایی مدلسازی میکند تا تصمیمات ایجنت در محیط شبیهسازی شده، کاملاً دقیق و قابلاطمینان باقی بماند. این دستاورد، مسیر را برای تست سریع و ایمن ایجنتهای پیشرفته هموارتر میکند. ✨
منبع: arXiv Machine Learning
