🛡 شناسایی هوشمند خطرات؛ معرفی SkillSieve برای ایجنت‌های هوش مصنوعی

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

با افزایش نفوذ ایجنت‌های هوش مصنوعی به سیستم‌های حساس، امنیت کدها و فایل‌هایی که این ایجنت‌ها اجرا می‌کنند اهمیت دوچندانی پیدا کرده است. محققان به تازگی فریم‌ورک جدیدی به نام «SkillSieve» معرفی کرده‌اند که به طور تخصصی برای شناسایی مهارت‌های مخرب در ایجنت‌های AI طراحی شده است.

این ابزار با استفاده از یک سیستم سه‌لایه (شامل تحلیل‌های Regex، بررسی ساختار کد و داوری توسط مدل‌های زبانی)، می‌تواند با دقت بسیار بالا (F1=0.929) و هزینه بسیار کم، کدهای آلوده را از کدهای امن تفکیک کند. این خبر برای توسعه‌دهندگان ایجنت‌ها و متخصصان امنیت یک گام رو به جلو در ایمن‌سازی دنیای هوش مصنوعی محسوب می‌شود.

🔗 جزئیات بیشتر و کدهای این پروژه به صورت متن‌باز منتشر شده است.

منبع: arXiv AI