آیا هوش مصنوعی میتواند در حین ارتقای خود، همچنان امن باقی بماند؟ پژوهش جدیدی با نام «Falsifiable Release Gates» منتشر شده که روشی علمی برای نظارت بر سیستمهای ایجنتیک معرفی میکند.
در این روش، هر قابلیت جدید پیش از انتشار باید از سدهای امنیتی «ماشین-تاییدپذیر» عبور کند. محققان با پیادهسازی این مدل در پلتفرم «Antahkarana»، ثابت کردند که میتوان با ابزارهای تست خودکار، امنیت سیستم را حتی پس از چندین مرحله توسعه و افزودن قابلیتهای پیچیده، کاملاً تضمین کرد. این گامی بزرگ برای رسیدن به هوش مصنوعیِ قابل اعتمادتر است! 🚀
منبع: arXiv AI
