محققان در مقاله جدیدی روشی نوآورانه به نام «Stochastic Token Steering» (STS) معرفی کردهاند که به جای اعمال تغییرات مداوم در تکتک کلمات (Token) تولید شده توسط مدل، تنها روی بخشهای خاصی از فرآیند تولید تمرکز میکند.
این روش چه فایدهای دارد؟
✅ حفظ کیفیت متن (روانی جملات)
✅ کاهش بار پردازشی و مداخلات غیرضروری
✅ کنترل رفتار مدل بدون نیاز به آموزش مجدد یا استفاده از مدلهای پاداش پیچیده
در واقع، محققان نشان دادهاند که با کنترل تنها ۵۰٪ از توکنها، میتوان تقریباً همان نتیجه کنترل کامل را گرفت. این یک قدم بزرگ برای بهینهسازی کنترل رفتار LLMها و جلوگیری از افت کیفیت متن خروجی است! 🚀
منبع: arXiv Machine Learning
