🛡 وقتی هوش مصنوعی مسئولیت‌های حیاتی می‌پذیرد: تست‌های نفوذ در اتاق کنترل نیروگاه!

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

آیا حاضرید کنترل یک نیروگاه هسته‌ای را به هوش مصنوعی بسپارید؟ این سوالی است که پژوهشگران با معرفی بنچمارک جدید NRT-Bench به سراغ آن رفته‌اند.

در این مطالعه، محققان عملکرد مدل‌های زبانی (LLM) را به عنوان اپراتورهای یک سیستم حساس (در یک شبیه‌ساز نیروگاه هسته‌ای) در برابر «حملات چندمرحله‌ای» بررسی کردند. نتایج جالبی به دست آمده:

✅ با اینکه مدل‌ها در نگاه اول ایمن به نظر می‌رسند، اما هر کدام نقاط ضعف منحصربه‌فردی دارند.
✅ حملات هدفمند می‌توانند در حدود ۹ تا ۱۲ درصد موارد، سیستم را به مرز شکست امنیتی برسانند.
✅ نکته کلیدی این است که هیچ دفاع واحدی برای همه مدل‌ها پاسخگو نیست و آسیب‌پذیری‌ها در مدل‌های مختلف کاملاً متفاوت است.

این تحقیق گام بزرگی برای درک خطرات استفاده از AI در سیستم‌های حیاتی است که امنیت واقعی اولویت اول آن‌هاست. نظر شما چیست؟ آیا می‌توان به هوش مصنوعی در زیرساخت‌های حساس اعتماد کرد؟

منبع: arXiv AI