🔍 رمزگشایی از درونِ مدل‌های هوش مصنوعی تصویرساز (DiT) 🎨✨

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

تا حالا فکر کردید وقتی یک مدل هوش مصنوعی (مثل مدل‌های تبدیل‌گر انتشار) دستور متنی شما را به تصویر تبدیل می‌کند، داخل مغز الکترونیکی‌اش چه می‌گذرد؟

محققان در مقاله‌ای تازه، پرده از اسرار «توکن‌های متنی» در این مدل‌ها برداشته‌اند. آن‌ها متوجه شدند که مدل‌ها چطور هویت اشیاء را در فرآیند تولید تصویر حفظ می‌کنند. جالب اینجاست که آن‌ها متوجه شدند بخشی از محاسبات مدل در واقع «اضافی» است!

نتیجه‌ی کاربردی این تحقیق؟ آن‌ها یک روش «هرس کردن» (Pruning) بدون نیاز به آموزش مجدد ابداع کردند که می‌تواند تا ۲۰ درصد از محاسبات مدل را حذف کند، بدون اینکه کیفیت تصویر افت محسوسی داشته باشد. این یعنی مسیر برای رسیدن به هوش مصنوعی سریع‌تر و بهینه‌تر هموارتر شده است! 🚀

منبع: arXiv Computer Vision