محققان در یک مقاله جدید، پارادایم تازهای برای آموزش مدلهای زبانی ارائه کردهاند که میتواند بازی را عوض کند! تا به امروز، اکثر مدلهای بزرگ (LLM) با دادههای اینترنتی تصفیه شده اما با اهداف محدود آموزش میدیدند. حالا «CuraWeb» وارد میدان شده تا با بهینهسازی همزمان سه فاکتور «کیفیت»، «تنوع» و «حذف دادههای تکراری»، استانداردی جدید برای دادههای آموزشی تعریف کند.
این متدولوژی جدید که بر پایه ترکیبی از فیلترهای مدلمحور و قواعد سختگیرانه ساخته شده، توانسته در مقایسه با روشهای فعلی، درک مدلها از دانشهای تخصصی و توانایی استدلال آنها را به شکل چشمگیری بهبود ببخشد. با این ابزار، میتوانیم منتظر مدلهای هوشمندتر و دقیقتری باشیم که دانشِ “دمدستی” را با عمقِ “دانش تخصصی” ترکیب میکنند. ✨
منبع: arXiv AI
