🔍 چرا مدل‌های زبانی در شمارش کلمات ناتوان‌اند؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

شاید برایتان پیش آمده باشد که از مدل‌های هوش مصنوعی بخواهید تعداد دفعات تکرار یک کلمه در لیست را بشمارند و آن‌ها با وجود هوشمندی بالا، به طرز عجیبی اشتباه کنند! 🤖

محققان در پژوهشی جدید به نتایج جذابی رسیده‌اند:

✅ مشکل از «دانش» مدل نیست؛ بلکه یک «اختلال در مسیر خروجی» است!
بررسی‌ها نشان می‌دهد که لایه‌های داخلی مدل، تعداد را درست محاسبه می‌کنند، اما یک بلاک خاص در لایه‌های انتهایی (MLP)، به صورت تعمدی پاسخ صحیح را با یک پاسخ غلط جایگزین می‌کند. این اتفاق در مدل‌های معروفی مثل Llama 3.2 و Qwen 2.5 مشاهده شده است.

این کشف مهم، راه را برای اصلاح ساختاری مدل‌ها در آینده باز می‌کند تا درک بهتری از نحوه پردازش داده‌ها پیدا کنیم.

منبع: arXiv Machine Learning