محققان تکنیک جدیدی به نام OPSD-V معرفی کردهاند که مشکل اصلی مدلهای تولید ویدیوی خودبازگشت (Autoregressive) یعنی افت کیفیت و کاهش پویایی در ویدیوهای طولانی را حل میکند.
این متد با استفاده از «خود-تقطیر» (Self-Distillation) و ترکیب دادههای ویدیویی واقعی به عنوان زمینه زمانی، اجازه میدهد مدل بدون نیاز به تغییر در مراحل استنتاج، ویدیوهایی با حرکتهای دقیقتر و کیفیت بصری بهمراتب بهتر تولید کند. نتایج آزمایشها نشان میدهد که این روش نسبت به مدلهای فعلی، برتری قابل توجهی در جلب رضایت کاربران داشته است. گامی بلند برای رسیدن به ویدیوهای طولانیتر و باکیفیتتر در دنیای هوش مصنوعی! 🚀✨
منبع: arXiv Computer Vision
