یکی از چالشهای بزرگ مدلهای تبدیل متن به تصویر (Text-to-Image)، دور زدن فیلترهای امنیتی توسط کاربران با استفاده از کلمات مبهم یا ترفندهای پیچیده است.
محققان بهتازگی فریمورک جدیدی به نام «UniNDM» معرفی کردهاند که به جای روشهای سنتی، از تحلیل «نویز» در فرآیند تولید تصویر استفاده میکند. این ابزار هوشمند میتواند محتوای مخرب را حتی در پشت لایههای پیچیده تشخیص داده و با کمک مدلهای زبانی بزرگ، جلوی تولید محتوای نامناسب را بگیرد.
این نوآوری گام مهمی در جهت افزایش ایمنی و کاهش سوگیریهای مدلهای هوش مصنوعی است. 🚀
منبع: arXiv Computer Vision
