مدلهای چندوجهی (VLM) که هم تصویر میبینند و هم متن را درک میکنند، حالا با چالشهای امنیتی زیادی روبرو هستند. محققان به تازگی سیستم جدیدی به نام VLMGuard را معرفی کردهاند که بدون نیاز به دادههای برچسبگذاری شده توسط انسان، میتواند دستورات (Prompts) مخرب و خطرناک را شناسایی کند.
این فریمورک با استفاده از یادگیری از دادههای خام و بدون برچسب در دنیای واقعی، دقت شناسایی حملات را تا ۵ درصد نسبت به روشهای قبلی بهبود داده است. گامی مهم برای ایمنتر کردن دنیای هوش مصنوعی! 🚀
منبع: arXiv Machine Learning
