یکی از چالشهای بزرگ در تولید ویدیو با هوش مصنوعی، حفظ ثبات کاراکترها و تداوم داستان در شاتهای مختلف است. حالا محققان مدل جدیدی به نام DreamShot معرفی کردهاند که دقیقاً برای حل همین مشکل طراحی شده است.
این مدل با بهرهگیری از تواناییهای مدلهای «ویدیو-دیفیوژن»، میتواند سکانسهای داستانی منسجم و حرفهای تولید کند. ویژگی کلیدی DreamShot این است که نه تنها از متن، بلکه از تصاویر مرجع برای حفظ هویت شخصیتها استفاده میکند تا در تمام شاتها، کاراکترها کاملاً یکسان باقی بمانند.
این ابزار جدید گامی بزرگ برای کارگردانها و تولیدکنندگان محتوای خلاق است تا بتوانند ایدههای بصری خود را با کیفیت و نظم بسیار بالاتری به تصویر بکشند. 🎥✨
منبع: arXiv Computer Vision
