محققان با معرفی مدل DETECT-3B-Omni، گام مهمی در مسیر تشخیص صداهای ساخته شده با هوش مصنوعی برداشتهاند. نکته کلیدی این مدل، استقلال کامل آن از محتوای گفتار، لهجه، جنسیت یا سن گوینده است.
این یعنی برخلاف مدلهای قبلی، این ابزار تنها روی «آرتیفکتهای صوتی» یا همان نشانههای فنی تولید دیجیتالی تمرکز میکند. در تستهای گسترده انجام شده با بیش از ۱۰ هزار نمونه صوتی، این مدل ثابت کرده که فارغ از اینکه چه کسی حرف میزند یا محتوا چیست، با دقت بسیار بالایی دیپفیکها را شناسایی میکند.
این یک قدم بزرگ برای امنیت سایبری و انطباق با قوانین حریم خصوصی مثل GDPR محسوب میشود! ✅
منبع: arXiv AI
