آیا میدانستید برخی تصاویر به گونهای طراحی شدهاند که برای چشم انسان عادی به نظر میرسند اما حاوی پیامهای توهینآمیز و مخفی هستند؟ مدلهای فعلی هوش مصنوعی (VLMها) در تشخیص این نوع محتوای «ضد اخلاقی» بسیار ضعیف عمل میکنند و دقت آنها گاهی زیر ۱۰ درصد است!
محققان با معرفی چارچوب جدیدی به نام Adaptive View Retrieval، راه حل خلاقانهای ارائه دادهاند. این سیستم به جای تکیه بر یک نگاه ساده، با ایجاد مجموعهای از دیدگاههای مختلف نسبت به تصویر، پیامهای پنهان را رمزگشایی و تحلیل میکند. این مدل توانسته دقت تشخیص محتوای آسیبزا را به بیش از ۹۳ درصد برساند که جهشی بزرگ در ایمنی هوش مصنوعی محسوب میشود. 🤖💡
منبع: arXiv AI
