تصور کنید آواتاری دارید که نه تنها به صورت آنی و بدون تاخیر با شما صحبت میکند، بلکه کاملاً طبیعی است و در طول گفتگو هویت و حالتهای چهرهاش را حفظ میکند! محققان به تازگی مدل جدیدی به نام «OmniMate» معرفی کردهاند که میتواند به صورت یکپارچه، تصویر، صدا و حالات چهره را برای آواتارهای تعاملی تولید کند.
ویژگی کلیدی این مدل، حل مشکل «تداوم هویت» است؛ یعنی در گفتگوهای طولانی، آواتار تغییر نمیکند و به لطف کنترلر جدیدی به نام GPC، میتواند به خوبی بین حالتهای گوش دادن و پاسخ دادن جابجا شود. این دستاورد میتواند آیندهی دستیارهای مجازی، بازیهای ویدئویی و آموزش آنلاین را متحول کند.
منبع: arXiv Computer Vision
