محققان در یک مطالعه جدید، منطق اخلاقی ۸ مدل بزرگ زبانی (از جمله OpenAI، Meta، Google و Anthropic) را زیر ذرهبین بردند. در این پژوهش، مدلها با دوراهیهای اخلاقی کلاسیک روبرو شدند تا ببینیم در تصمیمگیریهای حساس، چطور عمل میکنند.
نتایج جالب هستند:
✅ اکثر مدلها به سمت «به حداقل رساندن آسیب» و «عدالت» گرایش دارند.
⚖️ تفاوت اصلی در میزان قاطعیت آنها و اولویتبندی قوانین در برابر نتایج است.
این تحقیق نشان میدهد که اگرچه مدلهای هوش مصنوعی هنوز تحت تأثیر شخصیتهای «مؤدبانه و محتاطانه» خود هستند، اما درک ساختار اخلاقی آنها میتواند به ما کمک کند تا در آینده تعاملات انسانی و هوش مصنوعی را هوشمندتر و اخلاقیتر پیش ببریم. نظر شما چیست؟ آیا به قضاوت اخلاقی ماشینها اعتماد دارید؟
منبع: arXiv AI
