محققان موفق شدند با ترکیب دو تکنیک قدرتمند یعنی «تقطیر مدلهای دیفیوژن» (DMD) و «یادگیری تقویتی» (RL)، چارچوب نوآورانهای به نام DMDR معرفی کنند.
تا پیش از این، این دو روش به صورت جداگانه استفاده میشدند، اما در این روش جدید، یادگیری تقویتی کمک میکند مدل دقیقاً مطابق با ترجیحات انسانی عمل کند و DMD نیز مانع از رفتارهای مخرب مدل در طول آموزش میشود. نتیجه؟ کیفیت بصری خیرهکننده و پیروی دقیقتر از دستورات متنی (Prompt) در تعداد مراحل تولید بسیار کمتر!
این یعنی مدلهای دیفیوژن در آینده نه تنها سریعتر، بلکه باهوشتر و دقیقتر خواهند بود. 🧠✨
منبع: arXiv Computer Vision
