آیا تا به حال به این فکر کردید که هوش مصنوعی چطور میتونه کیفیت ویدیوهای فشردهشده رو درک و اصلاح کنه؟ محققان در چالش QoMEX 2026 موفق شدند مدلهای جدیدی به نام CompressedVQA-AEV رو معرفی کنن که در دو نسخه «مرجع» و «بدون مرجع» کار میکنه.
این مدلها با استفاده از معماریهای قدرتمندی مثل Swin-B و SigLIP2 میتونن کیفیت بصری ویدیوهای پیچیده رو به دقت تحلیل و پیشبینی کنن. نسخه FR این مدل حتی موفق شده رتبه اول رو در چالش جهانی کسب کنه! 🏆
این دستاورد خبر خیلی خوبی برای بهبود تجربهی استریم ویدیو در آینده نزدیکه. کدها هم برای توسعهدهندهها در گیتهاب قرار گرفته.
منبع: arXiv Computer Vision
