محققان در مقاله جدیدی، الگوریتم «ArenaRL» را معرفی کردهاند که مشکل رایج امتیازدهی در مدلهای هوش مصنوعی را حل میکند. در کارهای پیچیده و باز (مانند برنامهریزی سفر)، مدلهای فعلی با امتیازدهیِ عددی ساده دچار سردرگمی میشوند و تفاوتهای ظریف بین پاسخها را نمیفهمند.
ویژگیهای کلیدی ArenaRL:
✅ جایگزینی امتیازدهی نقطهای با «رتبهبندی نسبی» بینگروهی.
✅ استفاده از یک میدان مسابقه (Arena) رقابتی برای تولید سیگنالهای دقیقتر.
✅ افزایش بهرهوریِ یادگیری با کاهش پیچیدگی محاسباتی و دقت بالا در تخمین برتری مدل.
این نوآوری راه را برای ساخت ایجنتهای هوشمندتر و دقیقتر در محیطهای غیرقابل پیشبینی هموار میکند. نظر شما چیست؟ آیا هوش مصنوعی بالاخره در تصمیمگیریهای پیچیده انسانی به حد مطلوبی میرسد؟
منبع: arXiv Machine Learning
