محققان در دستاورد جدیدی، مدل «OneViewAll» را معرفی کردهاند که میتواند موقعیت سهبعدی اشیاء (6D Pose) را تنها با داشتن یک تصویر مرجع و بدون نیاز به مدلهای CAD، با دقت خیرهکننده ۹۲.۵ درصد شناسایی کند! 🚀
این مدل با بهرهگیری از «پیشفرضهای معنایی» (Semantic Priors) و پردازش هوشمندانه تقارن و ویژگیهای اشیاء، جایگزینی فوقالعاده سریع و دقیق برای روشهای پرهزینه قبلی است. این تکنولوژی برای رباتهایی که در محیطهای واقعی با اشیاء ناشناخته روبرو هستند، یک گام بزرگ رو به جلو محسوب میشود.
منبع: arXiv Computer Vision
