🔍 آیا مدل‌های هوش مصنوعی واقعاً «اخلاق‌مدار» هستند یا فقط فریب می‌خورند؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

یک تحقیق جدید نشان داده که سوگیری‌های مدل‌های زبانی بزرگ (LLM) در قضاوت‌های اخلاقی، همیشه به معنای تغییر در سیستم ارزش‌گذاری آن‌ها نیست! 🧠

نتایج این پژوهش جالب نشان می‌دهد که وقتی مدل‌ها در سوالات «بله/خیر» دچار تزلزل می‌شوند، دلیل اصلی آن معمولاً «سوگیری در ترتیب گزینه‌ها» (Order Bias) یا «وابستگی به کلمات» است، نه تغییر در استدلال اخلاقی آن‌ها. خبر خوب اینکه مدل‌های پیشرفته‌ای مثل GPT-5.5 در این زمینه بسیار پایدارتر عمل می‌کنند.

این یافته‌ها به ما کمک می‌کند تا بهتر بفهمیم چطور می‌توانیم مدل‌ها را برای قضاوت‌های دقیق‌تر و عادلانه‌تر توسعه دهیم. 🤖💡

منبع: arXiv AI