محققان در مطالعه جدیدی به چالشهای مهم در «مقایسههای جفتی» (Pairwise Comparisons) برای تنظیم و همراستایی مدلهای هوش مصنوعی پرداختهاند. این پژوهش نشان میدهد که تکیه بر نظرات محلی انسانها ممکن است نتواند اولویتهای کلی (مانند عدالت یا برابری) را به درستی منعکس کند و باعث بروز تناقض در رفتار مدل شود.
نتیجه کلیدی این تحقیق پیشنهاد میدهد که اجازه دادن به انسانها برای اعلام «عدم تصمیمگیری» در موارد خاص، نه تنها باعث کاهش خطاهای مدل میشود، بلکه یادگیری ترجیحات انسانی را سریعتر و دقیقتر میکند.
این دستاورد گام مهمی در جهت ساخت مدلهای هوش مصنوعی است که دقیقتر با ارزشهای انسانی هماهنگ میشوند.
منبع: arXiv AI
