محققان روشی جدید و نیمهخودکار برای سنجش میزان دانش مدلهای زبانی (LLM) در حوزه امنیت ابداع کردهاند. برخلاف روشهای قدیمی که نیاز به صرف وقت زیاد توسط متخصصان داشت، این متد از اطلاعات آژانسهای حفاظت از مصرفکننده استفاده میکند تا نقاط ضعف مدلهایی مثل GPT و Gemini را در تشخیص موضوعات حساسی مثل «سرقت هویت» و «کلاهبرداریهای جعل هویت» شناسایی کند.
این ابزار به ما کمک میکند بفهمیم کدام مدلها واقعاً امنیت را درک میکنند و در چه بخشهایی دچار توهم یا کمبود اطلاعات هستند. پیشرفت در این زمینه برای افزایش ایمنی کاربران در دنیای دیجیتال حیاتی است. 🤖🔒
منبع: arXiv AI
