🛡️ سنجش امنیت مدل‌های هوش مصنوعی؛ چه کسی در صدر است؟

با افزایش نگرانی‌ها درباره امنیت ایجنت‌های هوشمند و احتمال دور زدن محافظت‌های سایبری (Jailbreak)، یک “لیدربورد امنیت AI” جدید راه‌اندازی شده است.

این ابزار با استفاده از ۱۵۰۰ تلاش خودکار برای نفوذ، مدل‌های مختلف را به چالش می‌کشد. جالب است بدانید که در این ارزیابی، مدل‌های پیشرفته‌ای مثل Fable 5 و GPT-5.6 Sol عملکرد بسیار مقاوم‌تری نسبت به رقبای قدرتمندی مثل Gemini 3.1 Pro یا Grok 4.5 از خود نشان داده‌اند.

این پروژه قرار است با حملات جدیدتر و داده‌های گسترده‌تر به‌روزرسانی شود تا امنیت در دنیای مدل‌های زبانی شفاف‌تر شود.

منبع: Hacker News AI