محققان در یک مطالعه جدید روی مدلهای تشخیص گفتار (ASR) به نتایج جالبی رسیدند! برخلاف تصور قبلی، استفاده از دادههای زبانهای مشابه برای آموزش مدلهای تشخیص گفتار، در عمل تاثیر چندانی بر بهبود عملکرد مدلهای چندزبانه برای زبانهای کممنابع ندارد.
این تحقیق نشان میدهد که وقتی حداقل یک ساعت داده از زبان مقصد داشته باشیم، استراتژی «پیشتطبیق» با زبانهای مشابه عملاً دستاورد چشمگیری ندارد. این یافته میتواند مسیر توسعه مدلهای هوش مصنوعی برای زبانهای در حال توسعه را تغییر دهد. 🌐✨
منبع: arXiv NLP
