یکی از بزرگترین چالشهای دنیای هوش مصنوعی، استفاده از دادههای شخصی (PII) در مدلهای زبانی و خطر افشای آنهاست. حالا محققان با معرفی پروژه «PANOPTICON»، اولین بنچمارک استاندارد برای بررسی این نشتهای احتمالی را ایجاد کردهاند.
این پروژه شامل مجموعهای از ۶۷ هزار پرامپت حاوی دادههای شخصیسازی شده است که به متخصصان اجازه میدهد تا «حملات وارونگی پرامپت» (Prompt Inversion Attacks) را تحلیل و در برابر آنها دفاع کنند. این ابزار کلیدی، پایه و اساس تحقیقات آینده برای ساخت مدلهای ایمنتر و محرمانهتر خواهد بود. 🔒
منبع: arXiv AI
