تا حالا فکر کردید که داخل مغز مدلهای زبانی (LLM) چه میگذرد؟ محققان بهتازگی چارچوب جدیدی به نام InverseScope معرفی کردهاند که به جای تکیه بر فرضیات پیچیده ریاضی، مستقیماً از طریق «وارونسازی ورودی»، فعالیتهای عصبی مدل را تفسیر میکند.
این ابزار هوشمند به محققان کمک میکند تا بفهمند مدل دقیقاً چه مفاهیمی را در لایههای پنهان خود پردازش میکند. نکته جذاب اینجاست که InverseScope میتواند مفاهیم انتزاعیِ درونِ مدل را به زبانِ انسانی ترجمه کند و حتی برای مدلهای بزرگ تا ۱۴ میلیارد پارامتر هم بهخوبی مقیاسپذیر است. قدمی مهم برای رسیدن به هوش مصنوعی شفافتر و قابلاعتمادتر! 🧠💡
منبع: arXiv AI
