🚀 نوآوری جدید در آموزش مدلهای زبانی: استفاده از مدلهای کوچک برای ارتقای مدلهای بزرگ! 🧠💡 محققان روش جدیدی به نام S2L-PO معرفی کردهاند که در آن از مدلهای کوچکتر (مثل مدل ۱.۷ میلیاردی) به عنوان «کاوشگر» برای راهنمایی آموزش مدلهای بزرگتر استفاده میشود. برخلاف روشهای سنتی که با ایجاد نویز باعث سردرگمی مدل میشوند، این متد جدید با حفظ انسجام منطقی، دقت مدلهای بزرگ (مثل مدلهای ۸ میلیاردی) را در حل مسائل ریاضی تا ۸.۸٪ افزایش میدهد. این یعنی راهکاری هوشمندانه برای همگرایی سریعتر و افزایش کارایی آموزش مدلهای هوش مصنوعی!
منبع: arXiv AI
