💡 جراحی دقیق در مدل‌های زبانی: معرفی روش Targeted PD برای درک بهتر شبکه‌های عصبی

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان در یک پیشرفت هیجان‌انگیز، تکنیک جدیدی به نام «تجزیه هدفمند پارامتر» (tPD) را معرفی کردند که به ما اجازه می‌دهد مدل‌های بزرگ هوش مصنوعی را به قطعات کوچک و قابل‌فهم خرد کنیم. 🧩

🔹 چرا این خبر مهم است؟
معمولاً تحلیل مدل‌های غول‌آسا هزینه‌بر و بسیار دشوار است. با این روش جدید، دانشمندان می‌توانند فقط بخش‌هایی از شبکه عصبی را که برای پردازش یک دستور خاص نیاز است، جدا کرده و تحلیل کنند. در واقع، این یعنی «جراحی» روی هوش مصنوعی بدون آسیب زدن به بقیه عملکردهای آن!

این تحقیق نشان داده که می‌توان با تنها ۷ درصد محاسبات معمول، بخش‌های کلیدی یک مدل ترنسفورمر را استخراج کرد و یا حتی حافظه مدل را بدون ایجاد اختلال در خروجی‌های دیگر، اصلاح کرد. قدمی بزرگ به سمت هوش مصنوعی شفاف‌تر و قابل‌کنترل‌تر! 🧠✨

منبع: arXiv Machine Learning