مدلهای جریانساز (Normalizing Flows) همیشه به دلیل دقت بالا محبوب بودهاند، اما در رقابت با مدلهای انتشار (Diffusion Models) برای تولید تصاویر باکیفیت کمی عقب مانده بودند.
حالا با معرفی SRC-Flow، محققان راهکار جالبی پیدا کردهاند! این مدل با استفاده از یک «فشردهساز بازنمایی معنایی»، دادههای پیچیده تصویری را به فضای معنایی فشرده تبدیل میکند تا مدل هوش مصنوعی راحتتر و دقیقتر آنها را پردازش کند.
نتایج روی دیتاست ImageNet خیرهکننده است و این مدل موفق شده استانداردهای جدیدی را در تولید تصویر با حفظ دقت ریاضی و سرعت بالا ثبت کند. اگر به معماریهای پیشرفته هوش مصنوعی علاقه دارید، میتوانید کدهای این پروژه را در گیتهاب بررسی کنید.
🔗 لینک پروژه: https://github.com/longtaojiang/SRC-Flow
منبع: arXiv Computer Vision
