با افزایش نگرانیها درباره امنیت ایجنتهای هوشمند و احتمال دور زدن محافظتهای سایبری (Jailbreak)، یک “لیدربورد امنیت AI” جدید راهاندازی شده است.
این ابزار با استفاده از ۱۵۰۰ تلاش خودکار برای نفوذ، مدلهای مختلف را به چالش میکشد. جالب است بدانید که در این ارزیابی، مدلهای پیشرفتهای مثل Fable 5 و GPT-5.6 Sol عملکرد بسیار مقاومتری نسبت به رقبای قدرتمندی مثل Gemini 3.1 Pro یا Grok 4.5 از خود نشان دادهاند.
این پروژه قرار است با حملات جدیدتر و دادههای گستردهتر بهروزرسانی شود تا امنیت در دنیای مدلهای زبانی شفافتر شود.
منبع: Hacker News AI