محققان در یک پژوهش فنی و بسیار مهم، یک حفره امنیتی خطرناک را در عاملهای هوش مصنوعی (AI Agents) کشف کردهاند. مشکل از جایی شروع میشود که مدلها از طریق حافظههای بلندمدت و قابلیتهای RAG، اطلاعات را ذخیره میکنند؛ این یعنی هکرها میتوانند با «تزریق دستورات مخرب» در حافظه، عملاً از فیلترهای امنیتی ورودی عبور کنند!
نکته کلیدی این تحقیق این است که سیستمهای دفاعی فعلی در برابر حملات «تاخیردار» در حافظه کاملاً بیدفاع هستند. جالب اینکه حتی قویترین مدلها مثل نسخه جدید Gemini یا GPT-5.1 هم در این شرایط نفوذپذیر گزارش شدهاند. این مقاله تأکید میکند که برای امن کردن عاملهای هوشمند، باید به سراغ «سندباکس کردن حافظه» برویم، نه فقط فیلتر کردن ورودیها.
اگر در حوزه امنیت هوش مصنوعی یا طراحی عاملهای خودمختار فعالیت میکنید، خواندن این مقاله فنی برای درک لایههای جدید حملات ضروری است. 🔐
منبع: arXiv AI
