محققان در دستاورد جدیدی به سراغ بهبود کیفیت و کنترلپذیری در ترکیب تصاویر (Image Fusion) رفتهاند. مدل جدیدی به نام «ConFusion» معرفی شده که با استفاده از یادگیری فضای پیوسته، اجازه میدهد به شکلی بسیار دقیق و جزئینگر (Fine-grained)، تصاویر مادون قرمز و مرئی را با هم ترکیب کنید.
این مدل با بهرهگیری از هوش مصنوعی چندوجهی (Multimodal LLM)، قصد کاربر را درک کرده و بخشهای مختلف تصویر را به صورت هوشمند و دقیق با هم تلفیق میکند که خروجی بسیار باکیفیتتری برای کاربردهای حساس ارائه میدهد.
منبع: arXiv Computer Vision
