🛡️ هوش مصنوعی و نبرد با توهمات نفرت‌انگیز؛ راهکاری برای کشف محتوای مخفی!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

آیا می‌دانستید برخی تصاویر به گونه‌ای طراحی شده‌اند که برای چشم انسان عادی به نظر می‌رسند اما حاوی پیام‌های توهین‌آمیز و مخفی هستند؟ مدل‌های فعلی هوش مصنوعی (VLMها) در تشخیص این نوع محتوای «ضد اخلاقی» بسیار ضعیف عمل می‌کنند و دقت آن‌ها گاهی زیر ۱۰ درصد است!

محققان با معرفی چارچوب جدیدی به نام Adaptive View Retrieval، راه حل خلاقانه‌ای ارائه داده‌اند. این سیستم به جای تکیه بر یک نگاه ساده، با ایجاد مجموعه‌ای از دیدگاه‌های مختلف نسبت به تصویر، پیام‌های پنهان را رمزگشایی و تحلیل می‌کند. این مدل توانسته دقت تشخیص محتوای آسیب‌زا را به بیش از ۹۳ درصد برساند که جهشی بزرگ در ایمنی هوش مصنوعی محسوب می‌شود. 🤖💡

منبع: arXiv AI