🧠 آیا مدل‌های هوش مصنوعی واقعاً از دستورات ما پیروی می‌کنند؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

تحقیقات جدید نشان می‌دهد که «توانایی انجام یک وظیفه» (Task Competence) با «توانایی پیروی از دستورات» (Instruction Following) دو مقوله کاملاً متفاوت در دنیای هوش مصنوعی هستند!

محققان در این مطالعه، مدل‌های زبانی (به‌ویژه سری Qwen) را به چالش کشیدند تا ببینند اگر دستور کاربر با منطق اصلی مدل تضاد داشته باشد (مثلاً «پاسخ اشتباه بده» یا «معکوسِ پاسخ صحیح را بگو»)، مدل‌ها چه واکنشی نشان می‌دهند.

نتایج جالب است: مدل‌های کوچک‌تر با وجود هوشمندی، تمایل دارند دستوراتِ انحرافی را نادیده بگیرند و به دانش قبلی خود تکیه کنند، در حالی که مدل‌های بزرگ‌تر در کنترل رفتار خود شکست می‌خورند. این یعنی برای داشتن هوش مصنوعیِ قابل اعتماد، صرفاً افزایش مهارت‌های مدل کافی نیست و باید روی “کنترل رفتار” (Behavioral Control) تمرکز ویژه‌ای داشت. 🚀

منبع: arXiv NLP