بسیاری از مدلهای هوش مصنوعی امروزی، قابلیت جستجوی در وب (Deep Search) دارند، اما ارزیابی آنها فقط بر اساس دقت پاسخ نهایی، کافی نیست. محققان به تازگی مفهومی به نام «هوش تفویضی» (Delegation Intelligence) را معرفی کردهاند که بررسی میکند آیا مدل واقعاً میداند «کِی» و «چطور» باید جستجو کند.
ویژگیهای این پژوهش جدید:
✅ تفکیک تصمیمگیری برای جستجو از قابلیتهای ترکیب و صحتسنجی اطلاعات.
✅ معرفی بنچمارک جدید DelegSearchBench برای اندازهگیری دقیقتر عملکرد مدلها.
✅ اثبات اینکه دقت پاسخ نهایی همیشه به معنای درک عمیق مدل از ابزارهای جستجو نیست.
این تحقیق گام مهمی در جهت شفافتر کردن توانمندیهای واقعی ایجنتهای هوشمند (AI Agents) است. 🤖💡
منبع: arXiv AI
