محققان در پژوهشی جدید، پروتکل نوینی برای ارزیابی «ایجنتهای هوشمند در حوزه تحلیل ویدیو» (VideoQA) طراحی کردهاند. مشکل اصلی مدلهای فعلی این بود که برای هر سوال، مراحل پردازش را از ابتدا تکرار میکردند که باعث اتلاف منابع میشد.
این پروتکل جدید با استفاده از متدولوژی «Dynamic-SAGE»، نهتنها دقت پاسخگویی مدلها را تا ۷.۵ درصد افزایش داده، بلکه با سنتز ابزارهای ترکیبی، حدود ۲۸ درصد از تعداد عملیاتهای اضافه و فراخوانیهای غیرضروری کاسته است. این یعنی قدمی بزرگ به سوی ایجنتهای هوشمندِ اقتصادیتر و سریعتر! 🧠✨
منبع: arXiv Computer Vision
