محققان دنیای هوش مصنوعی معماری جدیدی به نام DuSPiT را معرفی کردند که قصد دارد مشکل «تولید تصاویر با جزئیات بالا» را حل کند. تا امروز، مدلهای ترنسفورمر دیفیوژن اغلب تصاویر را فشرده میکردند که باعث از دست رفتن برخی جزئیات ظریف میشد.
ویژگی کلیدی DuSPiT چیست؟
این مدل از دو شاخه مجزا تشکیل شده است:
۱. شاخه اول: برای درک ساختار کلی تصویر.
۲. شاخه دوم: برای تمرکز بر جزئیات دقیق و بافتهای پیچیده.
این معماری باعث میشود تصاویر خروجی نه تنها باکیفیتتر باشند، بلکه از نظر سرعت و کارایی (Quality-Efficiency Trade-off) نیز عملکرد بهتری نسبت به روشهای قبلی داشته باشند. پیشرفتهای اینچنینی به ما کمک میکند تا در آینده تصاویر واقعگرایانهتری را با صرف منابع کمتر تولید کنیم. 🎨✨
منبع: arXiv Computer Vision
