ویرایش ویدیویی با مدلهای هوش مصنوعی (Diffusion Models) همیشه با چالش «فروریزش اولویت» (Prior Collapse) روبرو بوده؛ جایی که مدل به جای ویرایش هوشمندانه، تصاویر را خراب میکرد یا به نسخه اولیه برمیگشت. 🎞️
محققان در مقاله جدیدی راهکار هوشمندانهای به نام ElasticTTT معرفی کردهاند. این متد با استفاده از تکنیکهای «منظمسازی توزیع هدف» و «زمانبندی نویز غیرهمگام»، به مدل اجازه میدهد بدون از دست دادن دانش اصلی خود، تغییرات خیرهکنندهای را در ویدیوها اعمال کند. این یعنی یک قدم بزرگ به سمت ویرایش ویدیوییِ دقیقتر و باکیفیتتر در دنیای AI! ✨
منبع: arXiv AI
