محققان تکنیک جدیدی به نام «Bayesian-LoRA» معرفی کردهاند که میتواند دقت مدلهای زبانی بزرگ (LLM) را به شکل چشمگیری بهبود ببخشد.
مشکل اصلی مدلهای فعلی این است که حتی وقتی از پاسخ خود مطمئن نیستند، با اعتمادبهنفس بالا پاسخ میدهند (به ویژه وقتی با دادههای محدود آموزش میبینند). این روش جدید با استفاده از مفاهیم احتمالات و ترکیب آن با LoRA، مدل را قادر میسازد تا عدم قطعیت خود را بهتر درک کند.
نتایج آزمایشها نشان میدهد که این روش علاوه بر حفظ دقت، توانسته خطاهای مدل را تا ۷۶ درصد کاهش دهد که جهشی بزرگ برای کاربردهای حساس و تحلیلهای دقیق است. به نظر میرسد این تکنیک، راهی هوشمندانه برای بهینهتر کردن مدلهای کوچکتر (تا ۳۰ میلیارد پارامتر) باشد. 🧠✨
منبع: arXiv AI
