با هوشمندتر شدن مدلهای هوش مصنوعی و تبدیل آنها به «عاملهای خودکار» (Autonomous Agents) که حافظه بلندمدت دارند، امنیت وارد فاز جدیدی شده است. پژوهشگران به تازگی یک آسیبپذیری خطرناک به نام Chronos را شناسایی کردهاند که میتواند حافظه و سیستم اعتقادی این عاملهای هوشمند را هدف قرار دهد.
در این مدل حملات (مثل Memory Injection)، مهاجم میتواند با نفوذ به حافظه مدل، آن را به یک «عامل خفته» (Sleeper Agent) تبدیل کند که در زمانهای خاص رفتارهای پیشبینینشده یا مخرب از خود نشان میدهد. خبر خوب این است که محققان در این مطالعه، راهحلهای دفاعی نوآورانهای مانند استفاده از محیطهای اجرایی امن (TEE) و روشهای جدید نظارتی را معرفی کردهاند تا جلوی این تهدیدات آیندهنگرانه را بگیرند.
امنیت در دنیای هوش مصنوعی روزبهروز اهمیت بیشتری پیدا میکند! نظر شما چیست؟ آیا هوش مصنوعیهای خودکار امن هستند؟
منبع: arXiv AI
