🛡 امنیت ایجنت‌های هوش مصنوعی در برابر نفوذهای مخفی!

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

آیا تا به حال به این فکر کرده‌اید که ایجنت‌های هوش مصنوعی چطور با ابزارهایی مثل Gmail یا Jira کار می‌کنند؟ محققان به‌تازگی پلتفرم جدیدی به نام «AgentRedBench» را معرفی کرده‌اند که به طور تخصصی برای شناسایی حفره‌های امنیتی در ایجنت‌های متصل به سرویس‌های SaaS طراحی شده است.

این تحقیق نشان می‌دهد که بسیاری از ایجنت‌های فعلی در برابر «تزریق پرامپت غیرمستقیم» (Indirect Prompt Injection) بسیار آسیب‌پذیر هستند و نرخ موفقیت حملات به آن‌ها بین ۳۲ تا ۸۱ درصد است! این ابزار با معرفی «AgentRedGuard»، موفق شده نرخ موفقیت این حملات را تا بیش از ۷۵ درصد کاهش دهد بدون اینکه عملکرد اصلی ایجنت مختل شود.

اگر در حوزه توسعه سیستم‌های ایجنتی فعالیت می‌کنید، بررسی این بنچمارک برای امنیت پروژه‌های شما حیاتی است.

منبع: arXiv AI