محققان در یک پیشرفت جدید، مدل هوش مصنوعی «ChainReaction» را معرفی کردهاند که مشکل «جعبهسیاه» بودن سیستمهای تحلیل ویدئو (VideoQA) را حل میکند.
این مدل بهجای حدس و گمان، از یک ساختار مرحلهبندی شده استفاده میکند که ابتدا «زنجیرههای علّی» (Causal Chains) را از ویدئو استخراج کرده و سپس بر اساس منطق و دلیل، به پرسشها پاسخ میدهد. این یعنی نه تنها دقت پاسخدهی بالاتر رفته، بلکه هوش مصنوعی میتواند به زبان ساده توضیح دهد که «چرا» به این نتیجه رسیده است! این گامی بزرگ برای افزایش شفافیت و اعتماد کاربران به مدلهای بینایی-زبانی است. 💡
منبع: arXiv AI
