حتماً میدانید که افزایش دمای (Temperature) مدلهای زبانی باعث خلاقیت بیشتر در پاسخها میشود، اما یک مشکل بزرگ وجود دارد: وقتی دما بالا میرود، سیستمهای ایمنی مدل ضعیف شده و ممکن است محتوای نامناسب تولید کند.
محققان در مطالعه جدید خود روشی به نام «Refusal-Gated Decoding» ارائه دادهاند که به مدل اجازه میدهد حتی در دماهای بالا، همچنان هوشیار بماند و از تولید پاسخهای مخرب جلوگیری کند. این روش بدون کاهش سرعت و کارایی، بین ۹۱ تا ۹۹ درصدِ توانایی مدل در امتناع از درخواستهای مضر را حفظ میکند. قدمی بزرگ برای امنتر کردن هوش مصنوعی در کاربردهای خلاقانه! 🧠✨
منبع: arXiv AI
