🛡️ آسیب‌پذیری جدید در مدل‌های هوش مصنوعی: وقتی «استایل» دور زدن را یاد می‌گیرد!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در یک پژوهش جدید، متد خطرناکی به نام «ASO» یا «بهینه‌سازی استایل‌های تقابلی» را معرفی کردند که می‌تواند امنیت مدل‌های چندرسانه‌ای (MLLM) را به چالش بکشد.

ماجرا اینجاست: این مدل‌ها شاید در درک محتوا هوشمند باشند، اما در برابر «تغییرات ظاهری و استایل‌های خاص» در تصاویر، به‌شدت آسیب‌پذیرند. هکرها با استفاده از این تکنیک، لایه‌های امنیتی و فیلترهای اخلاقی هوش مصنوعی را به راحتی دور می‌زنند.

این یافته ثابت می‌کند که برای امنیت هوش مصنوعی، نباید فقط روی «متن» تمرکز کرد؛ ظاهر و استایلِ ورودی‌ها هم می‌توانند یک سلاح امنیتی باشند.

منبع: arXiv AI