محققان در یک پژوهش جدید، به چالشی اساسی در آموزش مدلهای هوش مصنوعی پرداختهاند: «مقایسههای زوجی» (Pairwise Comparisons).
این روش که در حال حاضر استانداردی برای همسو سازی (Alignment) هوش مصنوعی با خواستههای انسان است، دو پیشفرض غلط دارد:
۱. اینکه مقایسههای محلی برای درک کامل ترجیحات پیچیده انسانی کافی هستند.
۲. اینکه انسانها همیشه میتوانند پاسخی قاطع به این سوالات بدهند.
این مقاله نشان میدهد که وقتی انسانها بین اولویتهای متضاد (مثل عدالت در برابر برابری) گیر میکنند، مدلهای هوش مصنوعی در یادگیری دچار خطا میشوند. راهکار پیشنهادی؟ «اجازه دادن به کاربر برای ابراز تردید!» این کار نه تنها دقت یادگیری را بالا میبرد، بلکه به مدل کمک میکند پیچیدگیهای ذهنی انسان را بهتر درک کند. 🤖✨
منبع: arXiv AI
