محققان در یک پژوهش بسیار جذاب، به سراغ دنیای درونی مدلهای زبانی (مثل Qwen و DeepSeek) رفتهاند تا ببینند این مدلها وقتی با زبانهای برنامهنویسی مختلف (Python و Rust) کار میکنند، چه فعالیتهایی در لایههای عصبیشان رخ میدهد.
نکته جالب این تحقیق:
✅ چه کاری انجام شود؟ (محتوای کار): مدلها در این بخش اشتراک نظر بالایی دارند و مشابه عمل میکنند.
✅ کجا و چگونه انجام شود؟ (ساختار محاسباتی): اینجاست که مدلها راه خود را جدا میکنند و سبک پردازشی متفاوتی را در لایههای مختلف نشان میدهند!
این تحقیق به ما نشان میدهد که «جهانی بودن» در هوش مصنوعی لزوماً به معنای یکسان بودن فرآیند پردازش نیست، بلکه به معنای درک مشترک از مفهوم است. دنیای معماری مدلها واقعاً شگفتانگیز است! 🧠💻
نویسی
منبع: arXiv Machine Learning
