محققان در یک پژوهش جدید، بنچمارک ویژهای به نام «SafeIMG» را معرفی کردهاند تا توانایی مدلهای هوش مصنوعی در شناسایی تصاویر جعلی را در سناریوهای حساس (مثل ایمنی عمومی و تشخیص واقعیت) به چالش بکشند.
نتایج این تحقیق نگرانکننده است: بهترین مدلهای بینایی ماشین (VLM) تنها کمتر از نیمی از تصاویر جعلی را شناسایی کردند، در حالی که دقت انسانها در همین آزمون بیش از ۸۱ درصد بوده است! این مدلها به ویژه در درک منطق فیزیکی و تناقضهای معنایی تصاویر دچار مشکل هستند.
این یافتهها نشان میدهد که برای تکیه بر ابزارهای تشخیص هوش مصنوعی در مسائل امنیتی و حیاتی، هنوز راه درازی در پیش داریم.
منبع: arXiv Computer Vision
