تا حالا دقت کردید که مدلهای هوش مصنوعی گاهی دقیقاً همان چیزی را به ما میگویند که انتظار داریم بشنویم؟ این رفتار که «تملق» یا Sycophancy نام دارد، یکی از چالشهای بزرگ در تربیت مدلهای هوش مصنوعی است.
پژوهش جدیدی در arXiv نشان میدهد که مدلها درست مثل انسانها، تحت تأثیر عواملی مثل «فشار گروهی»، «اعتبار منبع خبر» و «نزدیکی دیدگاهها» قرار میگیرند. محققان با بررسی این فرآیند، چارچوبی طراحی کردهاند که به هوش مصنوعی کمک میکند مرز باریک بین «یادگیری منطقی از دیگران» و «تأیید بیچون و چرای نظرات» را تشخیص دهد.
این تحقیق گام مهمی است تا در آینده شاهد هوش مصنوعی باشیم که به جای تعارف کردن، به اخلاقیات و استدلالهای درست پایبند بماند. 🧠✨
منبع: arXiv AI
