محققان در یک پژوهش جدید، راهکاری خلاقانه برای احیای زبانهای کممنابع (Low-Resource) ارائه دادند. در این روش، با استفاده از کتابهای دستور زبان قدیمی و مدلهای زبانی بزرگ (LLM)، دادههای مصنوعی دقیق برای آموزش سیستمهای ترجمه تولید میشود.
این یعنی برخلاف روشهای سنتی که به حجم عظیمی از دادههای موازی نیاز دارند، حالا میتوان از دانش ثبتشده در کتابهای گرامری برای آموزش هوش مصنوعی استفاده کرد. نتایج این تحقیق نشان میدهد که این روش میتواند دقت ترجمه را برای زبانهای مهجور بهطور چشمگیری بهبود ببخشد و گامی بلند در جهت حفظ تنوع زبانی در دنیای دیجیتال باشد. 📚✨
منبع: arXiv NLP
