آیا هوش مصنوعی میتواند مثل یک هکر حرفهای و بیسروصدا عمل کند؟ مقاله جدیدی با معرفی بنچمارک «StealthBench» به سراغ همین موضوع رفته است.
تیم تحقیق متوجه شده که اگرچه مدلهای هوش مصنوعی در شناسایی آسیبپذیریها خوب عمل میکنند، اما در رعایت اصول مخفیکاری (OPSEC) ضعفهای جدی دارند؛ مثلاً گاهی اطلاعات حساس را لو میدهند یا به سیستمهای اصلی آسیب میزنند. نتایج نشان میدهد حتی بهترین مدلها هم در ترکیبِ «حل مسئله» و «حفظ مخفیکاری» موفقیت زیر ۵۴٪ دارند.
به نظر شما، آیا روزی میرسد که هوش مصنوعی بتواند بدون لو دادن خودش، عملیات امنیتی پیچیده انجام دهد؟
منبع: arXiv AI
