تا حالا فکر کردید وقتی یک مدل زبانی (LLM) در حال تولید متن است، دقیقاً چه پردازشی در لایههای پنهان آن رخ میدهد؟ محققان در پژوهش جدیدشان تکنیک جالبی به نام «DecodeShare» معرفی کردهاند.
این روش نشان میدهد که یک فضای پنهانِ «اشتراکی» و با ابعاد پایین در زمان تولید متن (Decode) وجود دارد که بین تمام وظایف مدل مشترک است. محققان ثابت کردند که دستکاری این بخشِ خاص، تأثیر بسیار عمیقتری نسبت به سایر بخشها روی تصمیمگیری مدل دارد.
این یافته میتواند مسیر جدیدی برای «فعالسازی هوشمند» (Activation Steering) و کنترل دقیقتر رفتار مدلها باز کند و دقت ابزارهای هدایت مدل را به شدت بالا ببرد. 🔍
منبع: arXiv AI
