🛡️ حمله هوشمند به مدل‌های بینایی-زبانی: معرفی متد SAGA

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

آیا مدل‌های هوش مصنوعی واقعاً امن هستند؟ محققان به‌تازگی روشی پیشرفته به نام «SAGA» را معرفی کرده‌اند که می‌تواند با استفاده از مکانیزم توجه (Attention)، آسیب‌پذیری مدل‌های بینایی-زبانی (LVLM) را در برابر حملات خصمانه (Adversarial Attacks) شناسایی کند.

نکته جالب اینجاست که SAGA یک روش «جعبه‌سیاه» است؛ یعنی بدون دسترسی به پارامترها یا گرادیان‌های داخلی مدل اصلی، می‌تواند با تحلیل دقیقِ نقاط حساس تصویر، مدل را فریب دهد! این پژوهش گام مهمی برای درک نقاط ضعف امنیتی مدل‌های هوش مصنوعی در برابر حملات دستکاری تصویر محسوب می‌شود.

منبع: arXiv Computer Vision