محققان مدل جدیدی به نام «TANDEM» معرفی کردهاند که تحولی در تشخیص محتوای نفرتآمیز (Hate Speech) ایجاد میکند. برخلاف سیستمهای قدیمی که مثل یک «جعبه سیاه» عمل میکردند، این مدل میتواند با تحلیل همزمان صوت، تصویر و متن، دقیقاً بگوید چه بخشی از یک ویدئوی طولانی حاوی محتوای نامناسب است!
💡 نکته کلیدی: مدل TANDEM با استفاده از یادگیری تقویتی، بین مدلهای بینایی-زبانی و صوتی-زبانی ارتباط برقرار کرده و برخلاف روشهای سنتی، نیاز به بررسی تکتک فریمها ندارد. این یعنی دقت ۳۰ درصدی بیشتر در شناسایی اهداف و خروجیهای بسیار دقیقتر برای ناظران انسانی.
این پیشرفت گام بزرگی برای سالمسازی شبکههای اجتماعی است. نظر شما چیست؟ آیا هوش مصنوعی میتواند به طور کامل جای ناظران انسانی را در این حوزه بگیرد؟
منبع: arXiv AI
