تا به حال برایتان پیش آمده که بخواهید یک ویدئوی طولانی با چندین زاویه دوربین مختلف بسازید اما هوش مصنوعی در حفظ ثبات تصاویر شکست بخورد؟ محققان با معرفی «MV-Forcing» این مشکل را حل کردهاند.
این مدل جدید با استفاده از یک پل هندسی ۴بعدی، بین نماهای مختلف هماهنگی ایجاد میکند. نتیجه این کار چیست؟ ویدئوهایی با کیفیت بالا، بدون پرش و با طول دلخواه که در آن اشیاء و صحنهها کاملاً ثابت و واقعی به نظر میرسند. این مدل با روش یادگیری جدید خود، فاصله بین آموزش و اجرای واقعی را از بین برده و گامی بزرگ در تولید محتوای ویدئویی پویا محسوب میشود. 🚀
منبع: arXiv Computer Vision
