تولید ویدیو توسط مدلهای هوش مصنوعی (مبتنی بر DiT) به دلیل پیچیدگی محاسباتی، همیشه با چالشهای فنی زیادی روبرو بوده است. حالا محققان متد جدیدی به نام RotateAttention را معرفی کردهاند که به طور خاص برای مدلهای ویدیویی که از 3D RoPE استفاده میکنند، طراحی شده است.
این نوآوری با ترکیب تکنیکهای جدید در فشردهسازی (Quantization) و بهینهسازی «اتنشن»، باعث میشود مدلهای تولید ویدیو بدون افت کیفیت، بسیار سریعتر و بهینهتر اجرا شوند. در واقع این روش مشکل محاسبات سنگین در تولید ویدیو را با هوشمندی حل کرده و راه را برای ساخت ویدیوهای باکیفیتتر در سختافزارهای محدودتر هموار میکند. ✨
منبع: arXiv Computer Vision
