محققان در مطالعه جدیدی روی یک بنچمارک تازه به نام «InteractComp» متوجه یک نقطه ضعف بزرگ در ایجنتهای جستجوگر شدند: این مدلها در مواجهه با سوالات مبهم، بهجای پرسش و شفافسازی، دچار «اعتمادبهنفس کاذب» میشوند و پاسخهای نادرست ارائه میدهند!
جالب است بدانید در این تحقیق، بهترین مدلها تنها حدود ۱۳٪ موفقیت داشتند؛ این یعنی ایجنتهای هوش مصنوعی هنوز در تعامل پویا با کاربر ضعفهای جدی دارند و برخلاف بهبود سرعت جستجو، قابلیت «پرسشگری» آنها در ۱۵ ماه اخیر پیشرفت چشمگیری نداشته است.
آیا فکر میکنید در آینده ایجنتها یاد میگیرند قبل از حدس زدن، از ما سوال بپرسند؟
منبع: arXiv AI
