🛡️ آسیبپذیری جدید در دیوارههای دفاعی هوش مصنوعی! محققان در مطالعه جدیدی نشان دادند که سیستمهای دفاعی هوش مصنوعی که با روش «خودآزمایی» (Self-Check) کار میکنند، چندان هم نفوذناپذیر نیستند. این پژوهش ثابت میکند که با ترکیب دو روش ساده (کدگذاری و جستجوی best-of-N)، میتوان دفاع قدرتمند SAGE را دور زد. این یافتهها نشان میدهد که حتی پیشرفتهترین لایههای امنیتی هم در برابر حملات ترکیبی هوشمندانه، ممکن است دچار خطا شوند. دنیای امنیت هوش مصنوعی هر روز پیچیدهتر میشود!
منبع: arXiv AI
