با افزایش نفوذ ایجنتهای هوش مصنوعی به سیستمهای حساس، امنیت کدها و فایلهایی که این ایجنتها اجرا میکنند اهمیت دوچندانی پیدا کرده است. محققان به تازگی فریمورک جدیدی به نام «SkillSieve» معرفی کردهاند که به طور تخصصی برای شناسایی مهارتهای مخرب در ایجنتهای AI طراحی شده است.
این ابزار با استفاده از یک سیستم سهلایه (شامل تحلیلهای Regex، بررسی ساختار کد و داوری توسط مدلهای زبانی)، میتواند با دقت بسیار بالا (F1=0.929) و هزینه بسیار کم، کدهای آلوده را از کدهای امن تفکیک کند. این خبر برای توسعهدهندگان ایجنتها و متخصصان امنیت یک گام رو به جلو در ایمنسازی دنیای هوش مصنوعی محسوب میشود.
🔗 جزئیات بیشتر و کدهای این پروژه به صورت متنباز منتشر شده است.
منبع: arXiv AI
