آیا حاضرید کنترل یک نیروگاه هستهای را به هوش مصنوعی بسپارید؟ این سوالی است که پژوهشگران با معرفی بنچمارک جدید NRT-Bench به سراغ آن رفتهاند.
در این مطالعه، محققان عملکرد مدلهای زبانی (LLM) را به عنوان اپراتورهای یک سیستم حساس (در یک شبیهساز نیروگاه هستهای) در برابر «حملات چندمرحلهای» بررسی کردند. نتایج جالبی به دست آمده:
✅ با اینکه مدلها در نگاه اول ایمن به نظر میرسند، اما هر کدام نقاط ضعف منحصربهفردی دارند.
✅ حملات هدفمند میتوانند در حدود ۹ تا ۱۲ درصد موارد، سیستم را به مرز شکست امنیتی برسانند.
✅ نکته کلیدی این است که هیچ دفاع واحدی برای همه مدلها پاسخگو نیست و آسیبپذیریها در مدلهای مختلف کاملاً متفاوت است.
این تحقیق گام بزرگی برای درک خطرات استفاده از AI در سیستمهای حیاتی است که امنیت واقعی اولویت اول آنهاست. نظر شما چیست؟ آیا میتوان به هوش مصنوعی در زیرساختهای حساس اعتماد کرد؟
منبع: arXiv AI
