با پیشرفتهای اخیر در تبدیل گفتار، حفظ هویت گوینده به یک چالش جدی تبدیل شده است. محققان به تازگی سیستم جدیدی به نام NouveauVoice را معرفی کردهاند که به عنوان یک پلاگین قدرتمند، امکان تولید «صدای مستعار» با کیفیت بالا را فراهم میکند.
این ابزار با استفاده از یادگیری عمیق، علاوه بر حفظ ویژگیهای احساسی و وضوح کلام، با ایجاد تنوع بالا در صدای تولید شده، کارِ مدلهای تشخیص هویت مهاجم برای شناسایی گوینده اصلی را به شدت سخت کرده است (با نرخ خطایی بیش از ۳۸٪!). این دستاورد، گامی مهم برای افزایش امنیت و ناشناسی در محیطهای صوتی هوش مصنوعی است. 🎤✨
منبع: arXiv AI
