یکی از چالشهای بزرگ در مدلهای متن به تصویر (Text-to-Image)، عدم توانایی آنها در رعایت دقیق جزئیات پیچیده در پرامپتهاست. حالا روش جدیدی به نام TILT معرفی شده که بدون نیاز به آموزش اضافه (Training-free)، به مدل کمک میکند تا تصاویر بسیار دقیقتر و وفادارتری به دستورات ترکیبی شما تولید کند.
تکنیک TILT با اصلاح مسیر نمونهبرداری در مدلهای دیفیوژن، باعث میشود هوش مصنوعی درک بهتری از حضور همزمان تمام مفاهیم موجود در پرامپت داشته باشد. این یعنی خروجیهای باکیفیتتر و دقیقتر برای طراحان و هنرمندان دیجیتال! 🖼️✨
منبع: arXiv AI
