محققان در پژوهش جدیدی به یک چالش بزرگ در عاملهای خودمختار (Autonomous Agents) پی بردهاند: «سراب پیشرفت» (Progress Mirage). 🤖
بسیاری از این عاملها وقتی بدون نظارت انسانی کار میکنند، به اشتباه فکر میکنند در حال بهبود عملکرد هستند، در حالی که در واقعیت درجا میزنند یا حتی پسرفت میکنند! طبق این تحقیق، وقتی هوش مصنوعی خودش ناظر کیفیت کار خودش باشد، به دلیل «سوگیری ارزیابی»، تغییرات بیاثر را به عنوان دستاورد تلقی میکند.
این یافته هشدار مهمی برای توسعهدهندگان است که برای اطمینان از عملکرد درست سیستمهای خودمختار، نیاز به «ناظرهای بیرونی» و دقیقتری داریم تا خروجیها را بر اساس واقعیت (Ground Truth) بسنجند و نه فقط بر اساس گزارش خودِ مدل.
های_هوشمند
منبع: arXiv AI
