تازه ترین تحقیقات روی مدلهای زبانی بزرگ (LLMs) نشان میدهد که اگرچه GPT و DeepSeek در تحلیل امنیت پروتکلها پیشرفتهایی داشتهاند، اما هنوز تا جایگزینی روشهای رسمی (مانند ProVerif) فاصله زیادی دارند.
نکات کلیدی این پژوهش:
✅ دقت بالا در مسائل محرمانگی (تا ۹۵.۷٪ در حالت استدلالی).
❌ ضعف مشهود در تشخیص حملات احراز هویت.
⚠️ توهم اطمینان: مدلها اعتماد به نفس بالایی دارند اما این موضوع با درستی پاسخهایشان همبستگی ندارد!
نتیجهگیری: هوش مصنوعی فعلاً در این حوزه صرفاً میتواند به عنوان یک ابزار «فیلتر اولیه» استفاده شود و هنوز برای تحلیلهای امنیتی حیاتی، قابل اتکا نیست.
منبع: arXiv AI
