شاید برایتان پیش آمده باشد که از مدلهای هوش مصنوعی بخواهید تعداد دفعات تکرار یک کلمه در لیست را بشمارند و آنها با وجود هوشمندی بالا، به طرز عجیبی اشتباه کنند! 🤖
محققان در پژوهشی جدید به نتایج جذابی رسیدهاند:
✅ مشکل از «دانش» مدل نیست؛ بلکه یک «اختلال در مسیر خروجی» است!
بررسیها نشان میدهد که لایههای داخلی مدل، تعداد را درست محاسبه میکنند، اما یک بلاک خاص در لایههای انتهایی (MLP)، به صورت تعمدی پاسخ صحیح را با یک پاسخ غلط جایگزین میکند. این اتفاق در مدلهای معروفی مثل Llama 3.2 و Qwen 2.5 مشاهده شده است.
این کشف مهم، راه را برای اصلاح ساختاری مدلها در آینده باز میکند تا درک بهتری از نحوه پردازش دادهها پیدا کنیم.
منبع: arXiv Machine Learning
