محققان در مقاله جدیدی، تکنیک هوشمندانهای برای ارتقای مدلهای استدلالی (Reasoning Models) معرفی کردهاند که میتواند انقلابی در آموزش مدلها ایجاد کند.
💡 نکته جذاب اینجاست که بهجای استفاده از روشهای پیچیده و پرهزینه، آنها ابتدا مدل را با دادههای متنی ساده آموزش (Instruction Tuning) داده و سپس با ترکیب آن با مدل استدلالی اصلی، قابلیتهای استدلالی آن را در حوزههای مختلف (مثل کدنویسی و خلاصهسازی) به شکل چشمگیری بهبود بخشیدهاند. این روش، بهویژه برای حوزههایی که «سنجش درستی» (Verification) خروجی در آنها سخت است، بسیار کارآمد است.
این یعنی هوش مصنوعی در حال هوشمندتر شدن با هزینههایی بسیار کمتر از قبل است! 📈
منبع: arXiv Machine Learning
