🔍 پرده‌برداری از راز درونی LLMها: مدل‌های زبانی چگونه یاد می‌گیرند؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در یک پژوهش جدید، به لایه‌های درونی مدل‌های زبانی بزرگ (LLM) نفوذ کرده‌اند تا بفهمند این مدل‌ها هنگام «یادگیری در لحظه» (In-Context Learning) دقیقاً چه الگوریتمی را اجرا می‌کنند.

این تیم با ابداع روشی جدید به نام PAP (Principal Activations Probe)، توانستند سیگنال‌های محاسباتی خاصی را در لایه‌های مختلف مدل شناسایی کنند که مسئول پیش‌بینی‌های هوشمندانه هستند. این یافته‌ها ثابت می‌کند که LLMها صرفاً از روی شانس پاسخ نمی‌دهند، بلکه ساختارهای ریاضیِ پنهانی (مانند مدل‌های مارکوف مخفی) را در حافظه کاری خود شبیه‌سازی می‌کنند. 🧠✨

این دستاورد، درک ما از «جعبه سیاه» هوش مصنوعی را یک گام به جلو برده است.

منبع: arXiv Machine Learning