حتماً برای شما هم پیش آمده که مدلهای زبانی در رعایت دقیق دستورالعملهای خاص (System Prompts) دچار لغزش شوند. محققان با معرفی چارچوب جدید SyRuP، راهکار هوشمندانهای برای حل این مشکل ارائه کردهاند.
این روش بدون نیاز به آموزش مجدد مدل (Fine-tuning)، با استفاده از یک لایه «پاداشدهی» در زمان تولید متن (Decoding-time)، به مدل کمک میکند تا توکنها را دقیقتر و طبق محدودیتهای شما انتخاب کند. نتیجه؟ مدلهایی که حرفشنوتر هستند و با دقت بسیار بالاتری دستوراتِ سبک، فرمت و ایمنی را اجرا میکنند.
یک گام مهم برای کاربردیتر کردن هوش مصنوعی در محیطهای سازمانی که دقت در آنها حرف اول را میزند. 🚀
منبع: arXiv NLP
