یکی از چالشهای بزرگ در امنیت هوش مصنوعی، تفاوت سیاستهای نظارتی در محصولات مختلف است. گاهی یک تصویر در یک پلتفرم مجاز و در دیگری غیرمجاز است!
محققان به تازگی سیستم جدیدی به نام «PolicyShiftGuard» معرفی کردهاند که به جای اتکا به قوانین ثابت، میتواند خود را با سیاستهای متغیر تطبیق دهد. این مدل با استفاده از بنچمارک جدید PolicyShiftBench، یاد گرفته است که چگونه بر اساس قوانینِ در لحظه تصمیم بگیرد، نه اینکه فقط به ویژگیهای ظاهری تصویر تکیه کند. این یعنی گاردریلهای هوشمندتر که در برابر تغییرات سیاستها کمتر دچار خطا میشوند. 🧠✨
منبع: arXiv AI
