🚀 رمزگشایی از توانایی‌های مدل‌های زبانی: داده‌های متنوع، کلید استدلال بهتر! 🧠✨

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

تا حالا فکر کردید چرا برخی مدل‌های زبانی در استدلال‌های پیچیده بهتر عمل می‌کنند؟ محققان در یک پژوهش جدید دریافتند که «تنوع داده‌های آموزشی» نقشی حیاتی در تعمیم‌دهی مدل‌ها (Generalization) دارد.

آن‌ها متریک جدیدی به نام G-Vendi معرفی کردند که با تحلیل گرادیان‌ها، میزان تنوع داده‌ها را اندازه‌گیری می‌کند. علاوه بر این، فریم‌ورک Prismatic Synthesis را توسعه دادند که با تولید داده‌های مصنوعی هوشمند، نقاط ضعف مدل را در فضای گرادیان هدف قرار می‌دهد تا دقت استدلال ریاضی و منطقی مدل‌ها به شکل چشمگیری افزایش یابد. این یعنی گامی دیگر به سوی مدل‌هایی که واقعاً در دنیای واقعی «می‌فهمند»! 📈🤖

منبع: arXiv AI