✨ کنترل دقیق‌تر بر آواتارهای سخنگو با متد جدید STEER

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

تکنولوژی آواتارهای سه‌بعدی هر روز به واقعیت نزدیک‌تر می‌شود! محققان در مقاله‌ای جدید مدلی به نام «STEER» را معرفی کرده‌اند که انقلابی در نحوه تعامل آواتارها ایجاد می‌کند. 👤💬

برخلاف روش‌های قبلی که حرکات صورت را فقط بر اساس صدا تولید می‌کردند، STEER به ما اجازه می‌دهد جزئیاتی مثل «تماس چشمی»، «ریتم حرکات سر» و «احساسات» را به صورت مجزا کنترل کنیم. این یعنی آواتار شما حالا می‌تواند در یک گفتگوی دو نفره، بسیار هوشمندانه و طبیعی‌تر واکنش نشان دهد. 🤖✨

این مدل با استفاده از یک خط لوله جدید برای یادگیری رفتار از ویدیوهای واقعی و یک معماری ترنسفورمر، گام بزرگی برای ساخت آواتارهای تعاملی و فوق‌واقع‌گرایانه برداشته است.

منبع: arXiv Computer Vision