محققان در تازهترین دستاورد خود، مدل قدرتمند «AptAvatar» را معرفی کردهاند که تحولی در تولید آواتارهای سخنگو (Audio-driven) ایجاد میکند.
برخلاف روشهای قبلی که برای افزایش سرعت، کیفیت یا جزئیات حرکت را فدای کارایی میکردند، این مدل ۱۴ میلیارد پارامتری توانسته با تکنیکهای نوآورانه در «توزیع تقطیری»، آواتارهایی با کیفیت تولید استودیو و در عین حال بسیار سریع تولید کند.
این یعنی در آینده نزدیک، ساخت ویدیوهای واقعگرایانه با آواتارهای هوشمند برای تولید محتوا بسیار آسانتر و حرفهایتر خواهد شد.
منبع: arXiv Computer Vision
