تا امروز بیشتر مدلهای زبانی منتظر دستورات ما بودند، اما نسل جدید «ایجنتهای هوش مصنوعی» در حال حرکت به سمت پرواکتیو بودن (پیشدستی در حل مشکلات) هستند.
محققان در مقاله جدیدی، بنچمارک «PROBE» را معرفی کردهاند که بررسی میکند هوش مصنوعی چقدر میتواند:
۱. به دنبال مشکلات پنهان بگردد.
۲. گلوگاههای سیستم را شناسایی کند.
۳. خودکار برای حل آنها اقدام کند.
جالب است بدانید در این ارزیابی، حتی مدلهای پیشرفتهای مثل GPT-5 و Claude Opus-4.1 هم تنها توانستند ۴۰٪ امتیاز عملکرد را کسب کنند که نشان میدهد هنوز راه زیادی تا هوشمندیِ خودکار و بینقص باقی مانده است. 🤖🧠
منبع: arXiv AI
