محققان در یک دستاورد تازه، معماری جدیدی برای مدلهای «تولید ویدئو» (Video Diffusion Models) معرفی کردهاند که مشکل رایج «ناهماهنگی زمانی» را حل میکند.
این مدل با استفاده از یک رویکرد «دوجهته» (Bidirectional)، یاد گرفته است که حرکات را به صورت منطقی و بازگشتپذیر تحلیل کند. این یعنی برخلاف مدلهای قبلی که فقط مسیر رو به جلو را میدیدند، این هوش مصنوعی با درکِ بهترِ توالی فریمها، از لرزش و پرش تصاویر جلوگیری کرده و ویدئوهایی با کیفیت و ثبات بسیار بالاتر تولید میکند.
پیشرفتهای اینچنینی، راه را برای ساخت ویدئوهای واقعگرایانهتر توسط هوش مصنوعی هموارتر میکند! 🚀🎥
منبع: arXiv Computer Vision
