💡 روشی جدید برای کنترل هوشمندتر مدل‌های زبانی: «فرمان‌دهی تصادفی»!

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان در مقاله جدیدی روشی نوآورانه به نام «Stochastic Token Steering» (STS) معرفی کرده‌اند که به جای اعمال تغییرات مداوم در تک‌تک کلمات (Token) تولید شده توسط مدل، تنها روی بخش‌های خاصی از فرآیند تولید تمرکز می‌کند.

این روش چه فایده‌ای دارد؟
✅ حفظ کیفیت متن (روانی جملات)
✅ کاهش بار پردازشی و مداخلات غیرضروری
✅ کنترل رفتار مدل بدون نیاز به آموزش مجدد یا استفاده از مدل‌های پاداش پیچیده

در واقع، محققان نشان داده‌اند که با کنترل تنها ۵۰٪ از توکن‌ها، می‌توان تقریباً همان نتیجه کنترل کامل را گرفت. این یک قدم بزرگ برای بهینه‌سازی کنترل رفتار LLMها و جلوگیری از افت کیفیت متن خروجی است! 🚀

منبع: arXiv Machine Learning