تا حالا فکر کردید وقتی یک مدل هوش مصنوعی (مثل مدلهای تبدیلگر انتشار) دستور متنی شما را به تصویر تبدیل میکند، داخل مغز الکترونیکیاش چه میگذرد؟
محققان در مقالهای تازه، پرده از اسرار «توکنهای متنی» در این مدلها برداشتهاند. آنها متوجه شدند که مدلها چطور هویت اشیاء را در فرآیند تولید تصویر حفظ میکنند. جالب اینجاست که آنها متوجه شدند بخشی از محاسبات مدل در واقع «اضافی» است!
نتیجهی کاربردی این تحقیق؟ آنها یک روش «هرس کردن» (Pruning) بدون نیاز به آموزش مجدد ابداع کردند که میتواند تا ۲۰ درصد از محاسبات مدل را حذف کند، بدون اینکه کیفیت تصویر افت محسوسی داشته باشد. این یعنی مسیر برای رسیدن به هوش مصنوعی سریعتر و بهینهتر هموارتر شده است! 🚀
منبع: arXiv Computer Vision
