آیا هوش مصنوعی واقعاً میتواند یادگیریهای قبلی خود را «فراموش» کند؟ در یادگیری تقویتی آفلاین (Offline RL)، حذف دادههای خاص بعد از آموزش یکی از چالشهای بزرگ امنیتی و حریم خصوصی است.
محققان در مقاله جدید خود بنچمارکی به نام «TOUR» را معرفی کردهاند که به بررسی دقیقتر فرآیند unlearning (حذف آموختهها) میپردازد. این ابزار به ما نشان میدهد که ارزیابیهای فعلی گاهی فریبنده هستند و برای رسیدن به حریم خصوصی واقعی، باید نگاهی فراتر از امتیازات ساده به عملکرد مدلها داشت.
این تحقیق گامی مهم برای توسعه مدلهای هوش مصنوعیِ امنتر و قابلکنترلتر است. 🛡️✨
منبع: arXiv AI
