محققان در مقالهای جدید، فریمورک نوآورانه «RayOcc» را برای حل چالشهای دشوارِ بازسازی سهبعدی محیط معرفی کردهاند.
مشکل اصلی در مدلهای فعلی، «ابهام در عمق» و «انسداد» اجسام در تصاویر دوربین است که مانع از تشخیص دقیق سطوح میشود. RayOcc با استفاده از یک رویکرد مبتنی بر ترکیبی از توزیعهای گوسی (Gaussian Mixture Intensity)، برخلاف روشهای سنتی که فقط یک عمق غالب را در نظر میگیرند، اجازه میدهد چندین فرضیه برای اشغال فضا به طور همزمان وجود داشته باشد.
نتیجه این مدل، دقت خیرهکننده در پیشبینی اشغال سهبعدی (Occupancy Prediction) در بنچمارکهای مهمی مثل nuScenes است که گامی بزرگ برای بهبود عملکرد خودروهای خودران و رباتها محسوب میشود. 🚗🤖
بعدی
منبع: arXiv Computer Vision
