یکی از چالشهای بزرگ در مدلهای تولید ویدیوی هوش مصنوعی، افت کیفیت و به هم ریختگی تصویر در ویدیوهای طولانیمدت (مثل پرشهای رنگی یا لرزش تصویر) است. حالا محققان فریمورک جدید و خلاقانهای به نام «FreqForcing» ارائه دادند.
این متد که بدون نیاز به آموزش مجدد (Training-free) عمل میکند، با تحلیل «فرکانسهای تصویر» (Spectral Self-Anchoring)، پایداری بصری را حفظ کرده و اجازه میدهد ویدیوهای تا ۲ دقیقه، با کیفیت و حرکتهای طبیعیتری تولید شوند. با این روش، مدل میتواند تا ۲۴ برابر بیشتر از حد معمول، ویدیو را ادامه دهد بدون اینکه کیفیت کار «فروپاشیده» شود! 🚀✨
منبع: arXiv Computer Vision
