تولید ویدیوهای باکیفیت توسط مدلهای هوش مصنوعی (Diffusion Transformers) معمولاً بسیار زمانبر است، چون پردازش توالیهای طولانی در بخش «توجه» (Attention) به گلوگاه اصلی تبدیل میشود.
محققان در مقالهای جدید، متد «Sol-Attn» را معرفی کردهاند که بدون نیاز به آموزش مجدد، با استفاده از یک تکنیک هوشمندانه برای «خلوتسازی» (Sparsification) محاسبات در لحظه، میتواند سرعت تولید ویدیو را بهطور چشمگیری افزایش دهد و در عین حال کیفیت خروجی را حفظ کند. این یعنی در آینده نه چندان دور، ویدیوهای هوش مصنوعی را سریعتر و بهینهتر خواهیم ساخت! 🎬✨
منبع: arXiv Computer Vision
