🎥 تحولی در درک سه‌بعدی ویدیوها با مدل جدید ViGeo

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

آیا هوش مصنوعی می‌تواند هندسه صحنه‌ها را در ویدیوهای طولانی با دقت بالا درک کند؟ محققان به‌تازگی مدل بنیادین ViGeo را معرفی کرده‌اند که بدون نیاز به تغییرات معماری پیچیده، قادر است «عمق» (Depth) و «نرمال‌های سطحی» را در ویدیوها با ثبات زمانی بسیار بالا استخراج کند.

از ویژگی‌های جذاب ViGeo:
✅ پشتیبانی از ویدیوهای آنلاین (استریمینگ) و آفلاین.
✅ یادگیری بدون نظارت مستقیم و با استفاده از داده‌های عمومی.
✅ دقت خیره‌کننده در بازسازی صحنه‌ها و تخمین عمق، حتی در ویدیوهای بسیار طولانی.

این پیشرفت جدید، دریچه‌ای نو برای کاربردهایی مثل واقعیت افزوده (AR)، تدوین و بازسازی صحنه‌های سه‌بعدی به روی توسعه‌دهندگان می‌گشاید.

منبع: arXiv Computer Vision