با افزایش نفوذ «عاملهای هوشمند» (AI Agents) در کارهای حساس، خطر حملات تزریق دستور (Prompt Injection) به یکی از جدیترین چالشها تبدیل شده است. حالا محققان طراحی نوآورانهای به نام Twin Agent ارائه کردهاند که با جداسازی وظایف بین دو عامل «جستجوگر» (Explore Agent) و «امن» (Safe Agent)، امنیت را بدون افت کارایی تضمین میکند.
در این مدل، عامل جستجوگر اطلاعات مشکوک را بررسی کرده و فقط نکات فشرده و امن را به عامل دوم منتقل میکند. این روش باعث میشود عامل اصلی حتی در محیطهای ناامن هم به درستی عمل کند.
این تحقیق نشان میدهد که میتوان امنیت سیستمهای هوشمند را بدون قربانی کردن قابلیتهایشان ارتقا داد. 🚀
منبع: arXiv NLP
