یکی از چالشهای بزرگ در دنیای LLMها، تشخیص متنهای تولید شده توسط هوش مصنوعی و در عین حال حفظ حریم خصوصی است. روشهای فعلی برای واترمارکگذاری متن، معمولاً برای تایید اصالت، نیاز دارند کل محتوا فاش شود.
اما محققان بهتازگی فریمورک جدیدی به نام HeRo (Hierarchical Vocabulary Routing) معرفی کردهاند که امکان «افشای انتخابی» (Selective Disclosure) را فراهم میکند! با این روش، اطلاعات واترمارک به صورت سلسلهمراتبی دستهبندی میشود؛ یعنی هر بخش از داده فقط برای افراد مجاز قابل رمزگشایی است بدون اینکه کل متن لو برود.
این نوآوری نه تنها کیفیت متن را حفظ میکند، بلکه دقت تشخیص بالایی دارد و برای مسائل امنیتی و کپیرایت بسیار کاربردی است.
🔗 لینک کد: https://github.com/xuyangc03/hero-watermark
منبع: arXiv AI
