توسعه هوش مصنوعی نباید محدود به زبانهای پرگویش دنیا باشد. محققان بهتازگی خانوادهای از مدلهای متنباز و قدرتمند به نام «DONDO» را برای تشخیص گفتار (ASR) در زبانهای آفریقایی معرفی کردهاند.
این مدلها که بر پایه معماری w2v-BERT 2.0 ساخته شدهاند، ۲۷ زبان و گویش مختلف از کشورهایی مثل نیجریه، کنیا، غنا و زیمبابوه را پوشش میدهند. نکته جالب اینجاست که برای حل مشکل کمبود داده، از متون مذهبی به عنوان منبعی معتبر و دقیق برای آموزش استفاده شده است.
این پروژه نه تنها دقت تشخیص گفتار را به شکل چشمگیری افزایش داده، بلکه مدلهای نهایی را با مجوز آزاد Apache-2.0 در Hugging Face منتشر کرده تا توسعهدهندگان بتوانند به راحتی از آنها استفاده کنند. گامهای اینچنینی باعث دموکراتیزه شدن هوش مصنوعی در سراسر جهان میشود. 🌱
شناسی
منبع: arXiv NLP
