محققان در دستاورد جدیدی، چارچوب نوآورانهای برای «بخشبندی اشیاء پویا» (Dynamic Object Segmentation) معرفی کردهاند. این روش با ترکیب هوشمندانه دادههای بصری، بازسازی سهبعدی و اطلاعات معنایی (Semantic)، میتواند اشیاء را در ویدیوها با دقتی خیرهکننده از پسزمینه جدا کند.
ویژگی کلیدی این مدل، استفاده از معماری ترنسفورمر و یک روش جدید پسپردازش بر پایه SAM است که باعث میشود حتی در صحنههای پیچیده با چندین شیء مختلف، عملکردی عالی و در سطح State-of-the-art داشته باشد. این فناوری میتواند تحولی در بازسازی صحنههای سهبعدی و کاربردهای بینایی ماشین ایجاد کند.
منبع: arXiv Computer Vision
