تشخیص متنهای تولید شده توسط LLMها در برابر روشهایی مثل پارافریز کردن یا تغییرات جزئی کلمات، همیشه یک چالش بزرگ بوده است. حالا محققان فریمورک جدید «T5-CSBoost» را معرفی کردهاند که با استفاده از یادگیری کنتراستیو (Contrastive Learning)، امضای سبک نوشتاری مدلها را به دقت شناسایی میکند.
این مدل جدید بدون نیاز به تغییرات سنگین معماری، در برابر حملات خصمانه (Adversarial Perturbations) بسیار مقاوم است و توانسته در بنچمارکهای مختلف، نتایج خیرهکنندهای را در تشخیص انسان از ماشین ثبت کند. این گام بزرگی برای افزایش امنیت و اصالتسنجی محتوا در دنیای دیجیتال است! 🤖✨
منبع: arXiv NLP
