تحقیقات جدید نشان میدهد که «توانایی انجام یک وظیفه» (Task Competence) با «توانایی پیروی از دستورات» (Instruction Following) دو مقوله کاملاً متفاوت در دنیای هوش مصنوعی هستند!
محققان در این مطالعه، مدلهای زبانی (بهویژه سری Qwen) را به چالش کشیدند تا ببینند اگر دستور کاربر با منطق اصلی مدل تضاد داشته باشد (مثلاً «پاسخ اشتباه بده» یا «معکوسِ پاسخ صحیح را بگو»)، مدلها چه واکنشی نشان میدهند.
نتایج جالب است: مدلهای کوچکتر با وجود هوشمندی، تمایل دارند دستوراتِ انحرافی را نادیده بگیرند و به دانش قبلی خود تکیه کنند، در حالی که مدلهای بزرگتر در کنترل رفتار خود شکست میخورند. این یعنی برای داشتن هوش مصنوعیِ قابل اعتماد، صرفاً افزایش مهارتهای مدل کافی نیست و باید روی “کنترل رفتار” (Behavioral Control) تمرکز ویژهای داشت. 🚀
منبع: arXiv NLP
