محققان در مقاله جدیدی از فریمورک نوآورانه «REGLUE» رونمایی کردند که هدفش حل مشکل «درک معنایی» در مدلهای انتشار (Diffusion Models) است. تا پیش از این، مدلها برای درک جزئیات عمیق تصویر به آموزشهای طولانی نیاز داشتند، اما REGLUE با ترکیب هوشمندانه دادههای بصری (Global) و جزئیات دقیق (Local)، کیفیت تصاویر را بهشدت افزایش داده و سرعت رسیدن به خروجی نهایی را در مدلهایی مثل SiT بالا برده است. این یعنی در آینده نه چندان دور، تصاویر تولید شده توسط AI، دقیقتر و خیرهکنندهتر خواهند بود! ✨
منبع: arXiv Computer Vision
