با پیشرفت مدلهای هوش مصنوعی در تولید صدا (Text-to-Audio)، تشخیص محتواهای جعلی و دیپفیک صوتی به یک چالش بزرگ تبدیل شده است.
محققان به تازگی مجموعه دادهای جدید و جامع به نام SynSFX را معرفی کردهاند که شامل بیش از ۴۳ هزار کلیپ صوتی (ترکیبی از صداهای واقعی و تولید شده توسط ۷ مدل پیشرو) است. هدف از این پروژه، آموزش و ارزیابی دقیقتر مدلهای تشخیص دیپفیک است تا در برابر صداهای محیطی و افکتهای صوتی مصنوعی که تاکنون کمتر به آنها توجه شده بود، مقاومتر عمل کنند.
این دیتاست جدید میتواند گامی مهم برای افزایش امنیت و تشخیص هوشمند صداهای جعلی در فضای مجازی باشد. 🛡️
منبع: arXiv AI
