🔍 ابزاری جدید برای رمزگشایی از «ذهن» مدل‌های زبانی!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان به تازگی کتابخانه متن‌باز جدیدی به نام «CLT-Forge» را منتشر کرده‌اند که گامی بزرگ در حوزه تفسیرپذیری مکانیکی (Mechanistic Interpretability) مدل‌های هوش مصنوعی محسوب می‌شود.

این ابزار با استفاده از «ترانسکودرهای متقاطع» (CLTs)، به توسعه‌دهندگان کمک می‌کند تا نحوه پردازش اطلاعات در مدل‌های غول‌پیکر (LLMs) را به شکلی دقیق‌تر، فشرده‌تر و قابل‌فهم‌تر بررسی کنند.

اصلی‌ترین ویژگی‌های این پروژه:
✅ آموزش توزیع‌شده و مقیاس‌پذیر
✅ تحلیل خودکار ویژگی‌ها و ساخت نمودارهای انتساب (Attribution Graphs)
✅ رابط کاربری منعطف برای تجسم نحوه تصمیم‌گیری مدل‌ها

اگر در حوزه توسعه یا تحقیقات هوش مصنوعی فعالیت می‌کنید، این ابزار می‌تواند به درک بهتر «جعبه سیاه» مدل‌های هوش مصنوعی کمک کند.

🔗 لینک پروژه: https://github.com/LLM-Interp/CLT-Forge

‌نویسی

منبع: arXiv Machine Learning