تا به حال فکر کردید که چطور میشود مدلهای هوش مصنوعی را برای تولید تصویر با چندین کنترلکننده مختلف (مثل متن، اسکلتبندی، طرح اولیه و عمق) همزمان ترکیب کرد؟
محققان در یک دستاورد جدید، فریمورک «MixDiffusion» را معرفی کردهاند که بدون نیاز به آموزش مجدد (Training-free)، اجازه میدهد مدلهای مختلفِ تولید تصویر را با هم ادغام کنید. این یعنی انعطافپذیری فوقالعاده برای هنرمندان و توسعهدهندگانی که میخواهند خروجیهای دقیقتر و کنترلشدهتری از AI بگیرند.
نکته جالب اینجاست که این روش برای اضافه کردن قابلیتهای کنترلی جدید بسیار ساده و توسعهپذیر طراحی شده است.
منبع: arXiv Computer Vision
