خبر خوب برای محققان حوزه هوش مصنوعی و پردازش گفتار! بهتازگی مجموعه دادهای جامع و جدید به نام «Indic DiarBench» معرفی شده است که تحولی در زمینه تشخیص گوینده (Diarization) و تبدیل گفتار به متن (ASR) ایجاد میکند.
این بنچمارک شامل ۱۰۸ ساعت صوتِ واقعی و طبیعی از ۲۲ زبان رسمی هند است و بهطور خاص بر چالشهایی مثل ترکیب زبانها (Code-mixing)، لهجههای متنوع و همپوشانی گویندگان تمرکز دارد. این منبع باز (Open-access) میتواند به توسعه مدلهای هوش مصنوعیِ فراگیرتر و دقیقتر برای زبانهای آسیایی کمک شایانی کند.
اگر در زمینه مدلهای صوتی یا پردازش زبان طبیعی (NLP) فعالیت میکنید، این دیتاست یک مرجع ارزشمند برای تست و بهبود سیستمهای شماست. 🚀
منبع: arXiv NLP


