محققان در مطالعه اخیر خود راهکار جالبی برای آموزش مدلهای «تخمین دشواری متن» (Text Difficulty Assessment) ارائه دادهاند. چالش اصلی اینجاست که برای بسیاری از زبانها، دادههای برچسبگذاری شده توسط متخصصان کم است. این تیم پژوهشی با استفاده از یک استراتژی جدید، دادههای موجود در زبانهای غنی را با کمک ترجمه ماشینی به زبانهای کممنابع منتقل کردهاند.
نتیجه آزمایشها نشان میدهد که ترکیب دادههای محلی با دادههای ترجمهشده، دقت مدلهای BERT در پیشبینی سطح دشواری متون را به طرز چشمگیری افزایش میدهد. قدمی مهم برای بهبود ابزارهای آموزش شخصیسازی شده در زبانهای کمتر دیده شده! 🧠✨
منبع: arXiv Machine Learning
