تا به حال دقت کردید که هوش مصنوعی در حفظ جزئیات ریزِ تصاویر مثل لوگوها یا متنها چقدر مشکل دارد؟ محققان در یک پژوهش جدید، روشی نوآورانه برای رفع این ضعف معرفی کردهاند. این مدل با جداسازی «ساختار» از «ظاهر» تصویر، ابتدا نقشه ساختاری (Canny map) را پیشبینی کرده و سپس با استفاده از آن، تصویر نهایی را با دقت بسیار بالا بازسازی میکند.
این یعنی در ویرایشهای سنگین، دیگر شاهد افت کیفیت و محو شدن جزئیات کلیدی نخواهیم بود. خبر خوب اینکه همراه با این مقاله، یک دیتاست جدید برای بهبود درک متنی مدلها نیز منتشر شده است. پیشرفتهای اینچنینی، کیفیت خروجیهای هوش مصنوعی را به واقعیت نزدیکتر میکند! ✨
منبع: arXiv Computer Vision
