تا حالا فکر کردید چرا برخی مدلهای زبانی در استدلالهای پیچیده بهتر عمل میکنند؟ محققان در یک پژوهش جدید دریافتند که «تنوع دادههای آموزشی» نقشی حیاتی در تعمیمدهی مدلها (Generalization) دارد.
آنها متریک جدیدی به نام G-Vendi معرفی کردند که با تحلیل گرادیانها، میزان تنوع دادهها را اندازهگیری میکند. علاوه بر این، فریمورک Prismatic Synthesis را توسعه دادند که با تولید دادههای مصنوعی هوشمند، نقاط ضعف مدل را در فضای گرادیان هدف قرار میدهد تا دقت استدلال ریاضی و منطقی مدلها به شکل چشمگیری افزایش یابد. این یعنی گامی دیگر به سوی مدلهایی که واقعاً در دنیای واقعی «میفهمند»! 📈🤖
منبع: arXiv AI
