آیا هوش مصنوعی میتواند به اطلاعاتِ غلط اعتماد کند؟ محققان فریمورک جدیدی به نام «DeepStress» را معرفی کردهاند که به طور ویژه برای «استرستست» کردنِ عاملهای جستجوگر (Search Agents) طراحی شده است.
این ابزار به جای تستهای استاندارد، محیطی کنترلشده ایجاد میکند تا بررسی کند که اگر مدلها با اطلاعات نامعتبر، غیرمرتبط یا جعلی مواجه شوند، چه رفتاری از خود نشان میدهند. این پژوهش گامی مهم برای افزایش پایداری و اعتمادپذیریِ سیستمهای جستجوی هوشمند در دنیای واقعی است.
منبع: arXiv NLP
