تولید ویدیو با هوش مصنوعی همیشه چالشبرانگیز بوده، مخصوصاً وقتی میخواهیم حرکات دقیق چندین سوژه را کنترل کنیم. حالا محققان مدل جدیدی به نام «GraphVid» معرفی کردهاند که به جای درگیری با متنهای پیچیده یا رسم مسیرهای حرکتی دشوار، از «گرافهای تعاملی» برای کنترل ویدیو استفاده میکند.
ویژگیهای کلیدی GraphVid:
✅ کنترل دقیق و هوشمندانه تعاملات چندین سوژه در ویدیو.
✅ عملکرد فوقالعاده با دادههای کمتر و بهینهسازی پارامترها نسبت به روشهای قبلی.
✅ بهبود چشمگیر کیفیت ویدیو (افزایش PSNR و SSIM) و کاهش خطاهای تولید.
این مدل نشان میدهد که استفاده از رابطهای معنایی ساختاریافته میتواند آینده تولید ویدیوهای شخصیسازی شده را تغییر دهد. 🚀
وید
منبع: arXiv AI
