محققان در پژوهشی تازه کشف کردند که «مدلهای جهانی» (World Models) که به ایجنتهای هوش مصنوعی کمک میکنند محیط اطرافشان را درک کنند، میتوانند یک نقطه ضعف امنیتی جدی باشند. این مدلها که برای پیشبینی نتیجه اقدامات ایجنتها استفاده میشوند، ممکن است فریب بخورند و باعث اجرای کدهای مخرب یا سرقت اطلاعات حساس شوند.
نتایج این تحقیق نشان میدهد که نفوذگران میتوانند با نرخ موفقیت ۹۵٪، ایجنتها را به مسیرهای اشتباه بکشانند که نتیجه آن ممکن است تخلیه کیف پول دیجیتال یا دسترسی غیرمجاز باشد. این خبر زنگ خطری جدی برای توسعهدهندگان ایجنتهای خودکار است تا در پیادهسازی سیستمهای دفاعی و سختکردن امنیت این مدلها تلاش بیشتری کنند.
منبع: arXiv AI
