⚠️ خطر جدید در کمین ایجنت‌های هوش مصنوعی: «مدل‌های جهانی» آسیب‌پذیرند!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در پژوهشی تازه کشف کردند که «مدل‌های جهانی» (World Models) که به ایجنت‌های هوش مصنوعی کمک می‌کنند محیط اطرافشان را درک کنند، می‌توانند یک نقطه ضعف امنیتی جدی باشند. این مدل‌ها که برای پیش‌بینی نتیجه اقدامات ایجنت‌ها استفاده می‌شوند، ممکن است فریب بخورند و باعث اجرای کدهای مخرب یا سرقت اطلاعات حساس شوند.

نتایج این تحقیق نشان می‌دهد که نفوذگران می‌توانند با نرخ موفقیت ۹۵٪، ایجنت‌ها را به مسیرهای اشتباه بکشانند که نتیجه آن ممکن است تخلیه کیف پول دیجیتال یا دسترسی غیرمجاز باشد. این خبر زنگ خطری جدی برای توسعه‌دهندگان ایجنت‌های خودکار است تا در پیاده‌سازی سیستم‌های دفاعی و سخت‌کردن امنیت این مدل‌ها تلاش بیشتری کنند.

منبع: arXiv AI