🛡️ آسیب‌پذیری جدید در دیواره‌های دفاعی هوش مصنوعی! محققان در مطالعه جدیدی نشان دادند که سیستم‌های دفاعی هوش مصنوعی که با روش «خودآزمایی» (Self-Check) کار می‌کنند، چندان هم نفوذناپذیر نیستند. این پژوه

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

🛡️ آسیب‌پذیری جدید در دیواره‌های دفاعی هوش مصنوعی! محققان در مطالعه جدیدی نشان دادند که سیستم‌های دفاعی هوش مصنوعی که با روش «خودآزمایی» (Self-Check) کار می‌کنند، چندان هم نفوذناپذیر نیستند. این پژوهش ثابت می‌کند که با ترکیب دو روش ساده (کد‌گذاری و جستجوی best-of-N)، می‌توان دفاع قدرتمند SAGE را دور زد. این یافته‌ها نشان می‌دهد که حتی پیشرفته‌ترین لایه‌های امنیتی هم در برابر حملات ترکیبی هوشمندانه، ممکن است دچار خطا شوند. دنیای امنیت هوش مصنوعی هر روز پیچیده‌تر می‌شود!

منبع: arXiv AI