🛡 آسیب‌پذیری جدید در مدل‌های هوش مصنوعی: وقتی حافظه عاملِ نفوذ می‌شود!

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان در یک پژوهش فنی و بسیار مهم، یک حفره امنیتی خطرناک را در عامل‌های هوش مصنوعی (AI Agents) کشف کرده‌اند. مشکل از جایی شروع می‌شود که مدل‌ها از طریق حافظه‌های بلندمدت و قابلیت‌های RAG، اطلاعات را ذخیره می‌کنند؛ این یعنی هکرها می‌توانند با «تزریق دستورات مخرب» در حافظه، عملاً از فیلترهای امنیتی ورودی عبور کنند!

نکته کلیدی این تحقیق این است که سیستم‌های دفاعی فعلی در برابر حملات «تاخیردار» در حافظه کاملاً بی‌دفاع هستند. جالب اینکه حتی قوی‌ترین مدل‌ها مثل نسخه جدید Gemini یا GPT-5.1 هم در این شرایط نفوذپذیر گزارش شده‌اند. این مقاله تأکید می‌کند که برای امن کردن عامل‌های هوشمند، باید به سراغ «سندباکس کردن حافظه» برویم، نه فقط فیلتر کردن ورودی‌ها.

اگر در حوزه امنیت هوش مصنوعی یا طراحی عامل‌های خودمختار فعالیت می‌کنید، خواندن این مقاله فنی برای درک لایه‌های جدید حملات ضروری است. 🔐

منبع: arXiv AI