یکی از چالشهای بزرگ در استفاده از عاملهای هوشمند (AI Agents) که به ابزارهای مختلف دسترسی دارند، اعتماد به «توجیهات» (Rationales) آنهاست. حالا پژوهشگران با معرفی روش نوآورانه «EBTE»، لایهای امنیتی ایجاد کردهاند که اجازه نمیدهد مدلها صرفاً با توضیحات متنی خودسرانه، دسترسیهای غیرمجاز بگیرند.
در این روش، تمامی تصمیمات عامل هوشمند به «ادعاهای قابل بررسی» تبدیل شده و توسط سرور با سیاستهای امنیتی و دادههای واقعی تطبیق داده میشوند. به زبان ساده، EBTE مثل یک نگهبان هوشمند عمل میکند که قبل از اجرای هر دستوری، از صحت منطق و ایمنی آن مطمئن میشود تا ریسک سوءاستفاده یا خطای عاملها به حداقل برسد.
این پیشرفت گام بزرگی برای تجاریسازی ایمنتر مدلهای زبانی در سیستمهای حساس است.
منبع: arXiv AI
