ترکیب (Merging) چندین مدل که برای وظایف مختلف آموزش دیدهاند، همیشه یکی از چالشهای جذاب دنیای AI بوده است. اما تا امروز، بیشترِ تحقیقات روی مدلهای CLIP در حوزه تصویر متمرکز بود.
محققان در مقاله جدید خود به سراغ راهکاری نوآورانه به نام «Task Alignment Proxy» رفتهاند تا مدلسازی را برای سناریوهای پیچیدهتر بینایی ماشین (Vision Tasks) که از دِکودرهای غیرمشابه استفاده میکنند، عملیاتیتر کنند. این روش جدید، انتخاب هایپرپارامترها را بهشدت سریعتر کرده و اجازه میدهد مدلهای چندوظیفهای قویتری بسازیم.
اگر در حوزه بینایی ماشین و مدلهای ترکیبی فعال هستید، این مقاله مسیر جدیدی را پیش رویتان میگذارد.
🔗 مطالعه بیشتر: https://europe.naverlabs.com/task-alignment
منبع: arXiv Computer Vision
