آیا میدانستید ایجنتهای هوش مصنوعی وقتی از ابزارها استفاده میکنند، ممکن است ریسکهای امنیتی متفاوتی داشته باشند؟ محققان در این مقاله جدید، روش نوآورانهای برای «کنترل ریسک» معرفی کردهاند که به جای نگاه کلی به یک دستور، جزئیات و نقشهای مختلف آن را بررسی میکند.
مثلاً ایجنت ممکن است دسترسی به ایمیل داشته باشد؛ این مدل جدید کمک میکند تا بین محتوای ایمیل (که کمخطر است) و گیرنده یا اعتبارنامهها (که بسیار حساس هستند) تفکیک قائل شویم. این یعنی ایمنی بیشتر و خطای کمتر در استفاده از ابزارها توسط مدلهای زبانی! 🤖✨
منبع: arXiv Machine Learning
