تحقیقات جدید arXiv نشان میدهد که وقتی پای سود و منافع مالی به میان میآید، مدلهای زبانی بزرگ (LLMs) در دوراهیهای اخلاقی چندان قابل اعتماد نیستند! ⚖️
در این مطالعه، رفتار ۹ مدل هوش مصنوعی در بازیهای استراتژیک (مانند معمای زندانی) بررسی شد و نتایج جالبی به دست آمد:
✅ هیچ مدلی به صورت ثابت «اخلاقی» عمل نکرد.
✅ میزان همکاری مدلها بین ۷.۹٪ تا ۷۶.۳٪ متغیر بود.
✅ ساختار بازی و «چارچوببندی اخلاقی»، اصلیترین عوامل تغییر رفتار مدلها هستند.
این تحقیق هشدار میدهد که سپردن تصمیمات حساس به ایجنتهای هوش مصنوعی، زمانی که اهداف مالی با اصول اخلاقی در تضاد هستند، میتواند ریسکهای جدی به همراه داشته باشد. ⚠️
نظر شما چیست؟ آیا میتوانیم به اخلاقیات یک الگوریتم اعتماد کنیم؟
منبع: arXiv AI
