تا امروز، سیستمهای «توصیف خودکار صدا» (AAC) بیشتر روی تولید جملات ساده تمرکز داشتند، اما محققان در پژوهشی جدید، چارچوبی دقیق برای ارزیابی «توصیفات ساختاریافته» صوتی ارائه دادهاند.
این چارچوب جدید، خروجیهای صوتی را در ۵ محور تخصصی شامل تگها، تحلیل منطقی، اندازهگیریهای عددی و پروفایلهای طیفی بررسی میکند. با ترکیب قدرت مدلهای زبانی (LLM) و معیارهای دقیق ریاضی، این سیستم میتواند بهراحتی تفاوت بین یک تغییر جزئی در متن و یک خطای فاحش در درک صوت را تشخیص دهد.
این دستاورد گام بزرگی برای هوشمندتر کردن ابزارهای درک صوت در آینده نزدیک است. ✨
منبع: arXiv NLP
