با پیشرفت چشمگیر هوش مصنوعی، تشخیص صداهای جعلی (Deepfake) به یکی از چالشهای امنیتی اصلی تبدیل شده است. محققان به تازگی دریافتهاند که سیستمهای پردازش صوتی در دنیای واقعی (مثل حذف نویز یا کنترل گین) میتوانند دقت سیستمهای تشخیص دیپفیک را کاهش دهند.
در این پژوهش جدید، چارچوب نوآورانه TFCL معرفی شده که با استفاده از «یادگیری ثبات زمان-فرکانس»، به مدلها کمک میکند ویژگیهای اصلی صدا را حتی پس از تغییرات محیطی و نویزهای سیستمی حفظ کنند. این یعنی امنیت بیشتر در دنیای دیجیتال و دشوارتر شدن کار برای جاعلان صدا! 🎙️✨
منبع: arXiv AI
