تولید ویدیوهای باکیفیت توسط هوش مصنوعی معمولاً با چالش سنگین «محاسبات توجه» (Attention) روبروست. حالا محققان با معرفی سیستم جدید FVAttn، این گره را باز کردهاند!
این سیستم با استفاده از «توجه پراکنده» (Sparse Attention) و مدیریت هوشمندِ بارِ پردازشی بین GPUها، توانسته سرعت استنتاج مدلهای تولید ویدیو را تا بیش از ۲ برابر افزایش دهد و در عین حال، ۴.۴ برابر سریعتر از FlashAttention در بخش توجه عمل کند. این یعنی ویدیوهای باکیفیتتر با سرعتی بسیار بالاتر! 📈✨
منبع: arXiv Computer Vision
