🎥 ارزیابی دقیق‌تر ویدیوهای هوش مصنوعی با HVEval+ و MoE-Rater

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

تولید ویدیو با هوش مصنوعی هر روز واقعی‌تر می‌شود، اما چالش‌های کیفیت و هماهنگی هنوز باقی است! محققان به تازگی مجموعه داده عظیم «HVEval+» را معرفی کرده‌اند که شامل بیش از ۲۰ هزار ویدیو و هزاران جفت ارزیابی انسانی برای سنجش کیفیت فضایی، زمانی و انطباق متن با ویدیو است.

در کنار این دیتاست، مدل جدید «MoE-Rater» هم رونمایی شده که با ساختار Mixture-of-Experts، می‌تواند به صورت یکپارچه هم کیفیت ویدیو را ارزیابی کند و هم به سوالات تخصصی درباره محتوای آن پاسخ دهد. گام بزرگی برای استانداردسازی نسل جدید ویدیوهای هوش مصنوعی! 🚀✨

منبع: arXiv Computer Vision