حتماً میدانید که تکنیکهای «ناشناسسازی صدا» (Voice Anonymization) میتوانند هویت گوینده را در جملات کوتاه پنهان کنند. اما در مکالمات طولانی (مثل مصاحبهها یا تماسهای کاری)، خطر جدیدی وجود دارد: هوش مصنوعی میتواند با تحلیل دایره لغات و سبک صحبت کردن، فرد را حتی بدون شناختن صدایش شناسایی کند!
محققان در مقاله جدید خود به سراغ حل این چالش رفتهاند. آنها روشی را پیشنهاد دادهاند که با بازنویسی متن مکالمات در خط لوله ASR-TTS، سبکِ خاصِ بیانِ فرد را حذف میکند تا بدون از دست رفتنِ مفهومِ اصلیِ کلام، حریم خصوصی حفظ شود. استفاده از «پارافریز کردن» میتواند سد محکمی در برابر حملات شناسایی محتوا باشد.
این یک قدم مهم برای افزایش امنیتِ سیستمهای پردازشِ صوتی در دنیای واقعی است. 🤖✨
منبع: arXiv NLP
