حذف اشیاء از ویدیو همیشه یکی از چالشهای بزرگ بوده؛ یا کیفیت پایینی داشته و یا مثل مدلهای دیفیوژن، زمان زیادی برای رندر نیاز داشته. حالا محققان با معرفی مدل جدید «D2DF» (From-Draft-to-Draft-Free)، این فرآیند رو متحول کردن!
این مدل با استفاده از تکنیک «تقطیر دانش»، یاد گرفته که ویدیوها رو تنها در یک مرحله و با سرعت فوقالعاده بالا پردازش کنه. نکته جذابش اینه که دیگه نیازی به پیشنویس (Draft) نداره و خودش میتونه با دقت بالا، صحنهها رو بازسازی کنه. این یعنی سرعت خیرهکننده در کنار کیفیت خیرهکننده! 🚀✨
منبع: arXiv Computer Vision
