در دنیای رقابتی «باندیتهای خطی»، گاهی بازوها (Arm) با ارائه اطلاعات غلط سعی میکنند شانس انتخاب شدن خود را بالا ببرند. محققان به تازگی الگوریتم جدیدی به نام MESHA طراحی کردهاند که نه تنها فریب نمیخورد، بلکه با یک مکانیسم نظارتی دقیق (Grim Trigger Condition)، بازوهایی که اطلاعات غیرواقعی میدهند را شناسایی و حذف میکند.
این نوآوری در محیطهایی که صداقت عاملهای سیستم تضمینشده نیست، یک قدم بزرگ رو به جلو برای هوش مصنوعیِ قابلاعتماد و بهینهسازی تصمیمات است.
منبع: arXiv Machine Learning
