حتماً برایتان پیش آمده که هنگام صحبت کردن، جملات را با ترکیب دو زبان (مثلاً ماندارین و انگلیسی) بیان کنید. این پدیده که به آن «کد-سوئیچینگ» میگویند، یکی از بزرگترین چالشها برای سیستمهای تشخیص گفتار (ASR) است.
محققان در پژوهشی جدید، از تکنیک «شبهبرچسبگذاریِ تکرارشونده» (Iterative Pseudo-Labeling) برای آموزش مدلهای ASR استفاده کردهاند. این روش با بهرهگیری هوشمندانه از دادههای بدون برچسب، دقت تشخیص گفتار در محیطهای چندزبانه را به شکل چشمگیری بهبود بخشیده است. این دستاورد میتواند راه را برای دستیابی به دستیارهای صوتی هوشمندتر و چندزبانه بازتر کند. 🚀
منبع: arXiv NLP
