🛡️ آیا هوش مصنوعی می‌تواند از محیط‌های امن فرار کند؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان به تازگی بنچمارک جدیدی به نام SANDBOXESCAPEBENCH معرفی کرده‌اند که هدف آن بررسی امنیت مدل‌های زبانی بزرگ (LLM) است.

این ابزار ارزیابی، بررسی می‌کند که آیا هوش مصنوعی در نقش یک «عامل خودمختار» می‌تواند با بهره‌برداری از نقاط ضعف سیستم، از داخل کانتینرهای امنیتی (Sandbox) فرار کند یا خیر. نتایج نشان می‌دهد که مدل‌ها در صورت وجود آسیب‌پذیری، قادر به شناسایی و اکسپلویت آن‌ها هستند. این تحقیق زنگ خطری جدی برای توسعه‌دهندگانی است که از LLMها در محیط‌های حساس استفاده می‌کنند تا اهمیت امنیت در معماری‌های ابری و کانتینری را جدی‌تر بگیرند.

منبع: arXiv AI