محققان در پژوهش جدیدی، راهکار نوآورانهای برای تولید دادههای مصنوعی (Synthetic Data) ارائه دادهاند که دو چالش بزرگ را حل میکند: «شفافیت» و «حفظ حریم خصوصی».
این روش به کاربران اجازه میدهد دقیقاً بدانند کدام روابط بین دادهها در نسخه مصنوعی حفظ شده است و همزمان تضمین میکند که دادههای تولید شده از استانداردهای سختگیرانه برای جلوگیری از نشت اطلاعات (Disclosure Risk) پیروی میکنند. این رویکرد میتواند تحولی در پروژههای تحقیقاتی حساس، مثل دادههای سرشماری ایجاد کند. 🔐💡
منبع: arXiv Machine Learning
