با رشد استفاده از مدلهای زبانی (LLM) و دادههای مصنوعی، نگرانیها درباره نشت اطلاعات حساس افزایش یافته است. محققان به تازگی چارچوب آماری جدیدی را معرفی کردهاند که میتواند بدون نیاز به دسترسی مستقیم به مدل، نشت دادههای خصوصی را شناسایی کند.
این متد که با نام «Phantoms and Disclosures» معرفی شده، تفاوت بین بازتولید تصادفی دادهها و لو رفتن اطلاعات واقعی کاربران را به دقت تشخیص میدهد. این یک گام بزرگ برای توسعهدهندگان است تا امنیت و حریم خصوصی را در مدلهای هوش مصنوعی پیش از انتشار عمومی تضمین کنند. 🔒💻
منبع: arXiv AI
