دنیای تولید ویدیو با هوش مصنوعی در حال برداشتن قدمهای بزرگی است! مدل جدید HunyuanVideo-HOMA معرفی شده که بهطور تخصصی برای بهبود «تعامل انسان و اشیاء» (HOI) در ویدیوها طراحی شده است.
تفاوت اصلی این مدل چیست؟
✅ کاهش وابستگی به دادههای حرکتی سنگین و پرهزینه.
✅ استفاده از معماری MMDiT برای ایجاد ویدیوهای واقعگرایانه و منسجم.
✅ قابلیت هماهنگسازی دقیق حرکات لب با صدا (Lip-Sync).
✅ کنترلپذیری بسیار بالا برای تولید انیمیشنهای تعاملی.
این ابزار نه تنها برای محتواسازها، بلکه برای توسعهدهندگانی که به دنبال تولید حرکات طبیعی در محیطهای شبیهسازی هستند، یک تحول محسوب میشود.
🔗 برای بررسی دموی این پروژه میتوانید به وبسایت آنها سر بزنید.
منبع: arXiv Computer Vision
