تحقیقات جدید نشان میدهد که نباید بیش از حد به توافق مدلهای زبانی (LLM) با یکدیگر یا با خودشان اعتماد کرد. بر خلاف تصور رایج، «اتفاقنظر» همیشه به معنای «حقیقت» نیست!
محققان با بررسی ۲۶۵ هزار نمونه خروجی متوجه شدند که مدلهای پیشرفته (Frontier Models) اغلب دچار «اعتمادبهنفس کاذب» میشوند؛ یعنی در عین حال که با خودشان توافق دارند، پاسخهای اشتباه تولید میکنند. این یافتهها برای توسعهدهندگانی که از هوش مصنوعی برای ارزیابی یا تصمیمگیری در سیستمهای حساس استفاده میکنند، یک زنگ خطر مهم است. گاهی اوقات مدلها به دلیل سوگیریهای مشترک یا الگوهای تکراری، همصدا میشوند اما مسیر را اشتباه میروند.
بهخاطر داشته باشید: هوش مصنوعی هنوز در تشخیصِ تفاوت بین «اعتمادبهنفس» و «واقعیت» مسیر زیادی برای طی کردن دارد.
منبع: arXiv AI
