تا به حال به این فکر کردهاید که چطور میتوان بدون خراب کردن ویژگیهای اصلی صورت، آرایش یک تصویر را روی چهرهای دیگر پیاده کرد؟ محققان بهتازگی مدل جدیدی به نام «MagicMakeup» را معرفی کردهاند که بر پایه ترنسفورمرهای انتشار (Diffusion Transformer) کار میکند.
چالش اصلی در این حوزه، حفظ هویت فرد و جلوگیری از پخش شدن رنگها در نواحی غیرهدف بود. اما این مدل با استفاده از:
✅ مکانیزم «Token-Aligned Region Gating» برای کنترل دقیق نواحی صورت
✅ تکنیک «Cross-Modal Perception Guidance» برای تفکیک بهتر مفهوم آرایش از هویت فرد
توانسته به خروجیهای بسیار باکیفیت و دقیق در ابعاد 1024×1024 برسد.
این پیشرفت نه تنها برای ویرایشهای خلاقانه عکس، بلکه در دنیای مد و صنعت زیبایی دیجیتال کاربردهای فوقالعادهای خواهد داشت! 🖼️✨
منبع: arXiv Computer Vision
