یک تحقیق جدید نشان داده که سوگیریهای مدلهای زبانی بزرگ (LLM) در قضاوتهای اخلاقی، همیشه به معنای تغییر در سیستم ارزشگذاری آنها نیست! 🧠
نتایج این پژوهش جالب نشان میدهد که وقتی مدلها در سوالات «بله/خیر» دچار تزلزل میشوند، دلیل اصلی آن معمولاً «سوگیری در ترتیب گزینهها» (Order Bias) یا «وابستگی به کلمات» است، نه تغییر در استدلال اخلاقی آنها. خبر خوب اینکه مدلهای پیشرفتهای مثل GPT-5.5 در این زمینه بسیار پایدارتر عمل میکنند.
این یافتهها به ما کمک میکند تا بهتر بفهمیم چطور میتوانیم مدلها را برای قضاوتهای دقیقتر و عادلانهتر توسعه دهیم. 🤖💡
منبع: arXiv AI
