🚀 آینده درک بصری: معرفی IGGT4D برای فهم دقیق ویدیوهای سه‌بعدی

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در تازه‌ترین دستاورد خود، مدل «IGGT4D» را معرفی کرده‌اند که انقلابی در نحوه درک هوش مصنوعی از دنیای پیرامون ایجاد می‌کند! 🌐

تا پیش از این، اکثر مدل‌ها در تحلیل ویدیوهای طولانی که اشیا مدام در حرکت هستند یا ناپدید و ظاهر می‌شوند، ضعف داشتند. اما IGGT4D با پردازش متوالی فریم‌ها و ترکیب هندسه با هویت اشیا، اجازه می‌دهد هوش مصنوعی محیط‌های پویا را به‌صورت سه‌بعدی و در لحظه درک کند. همچنین دیتاسِت عظیم ۱۴۷ هزارتایی برای آموزش این مدل منتشر شده که دریچه‌ای تازه به سوی «هوش فضایی» است. 🤖✨

منبع: arXiv Computer Vision