محققان به تازگی بنچمارک جدیدی به نام SANDBOXESCAPEBENCH معرفی کردهاند که هدف آن بررسی امنیت مدلهای زبانی بزرگ (LLM) است.
این ابزار ارزیابی، بررسی میکند که آیا هوش مصنوعی در نقش یک «عامل خودمختار» میتواند با بهرهبرداری از نقاط ضعف سیستم، از داخل کانتینرهای امنیتی (Sandbox) فرار کند یا خیر. نتایج نشان میدهد که مدلها در صورت وجود آسیبپذیری، قادر به شناسایی و اکسپلویت آنها هستند. این تحقیق زنگ خطری جدی برای توسعهدهندگانی است که از LLMها در محیطهای حساس استفاده میکنند تا اهمیت امنیت در معماریهای ابری و کانتینری را جدیتر بگیرند.
منبع: arXiv AI
