مدلهای ویرایش سهبعدی (3D Editing) تا به امروز عمدتاً بدون آموزش پیشدستانه عمل میکردند، اما حالا با معرفی متد جدیدی به نام «Pxform» و مدل «PartFlow»، وارد فاز جدیدی از دقت و سرعت شدهایم.
این پژوهش با استفاده از یک مجموعه داده عظیم شامل ۱۰۰ هزار جفت تصویر قبل و بعد از ویرایش، به هوش مصنوعی یاد میدهد که اشیاء را نه به صورت تودهای از نقاط، بلکه به عنوان «اجزای معنایی» (Semantic Parts) درک کند. این یعنی ویرایشهای دقیقتر، حفظ جزئیات هندسی و انسجام بینظیر در مدلهای سهبعدی! ✨
این پیشرفت میتواند مسیر تولید محتوای سهبعدی مقیاسپذیر را برای طراحان و توسعهدهندگان بازی و واقعیت مجازی به کلی تغییر دهد. 🚀
منبع: arXiv Computer Vision
