محققان روش جدیدی ابداع کردهاند که به مدلهای زبانی بزرگ (LLM) اجازه میدهد در زمان اجرا (Inference)، تصمیمات دقیقتری بگیرند. این لایه سبک که «Multi-Head Latent Control» نام دارد، بدون نیاز به تغییر در مدل اصلی، از وضعیت لایههای پنهان مدل استفاده میکند تا تصمیم بگیرد مدل باید خودش پاسخ دهد، از ابزارهای خارجی استفاده کند یا وظیفه را به یک مدل قویتر بسپارد.
💡 این دستاورد باعث میشود تعادل بسیار بهتری بین کیفیت پاسخدهی و هزینههای محاسباتی در سیستمهای هوش مصنوعی ایجاد شود.
منبع: arXiv NLP
