محققان در یک پژوهش جدید، عملکرد مدلهای بینایی-زبانی (VLM) مثل Gemini، GPT و Llama را برای تشخیص خودکار «کلیپینگ هندسی» در بازیهای ویدئویی بررسی کردهاند. 🕹️
نتیجه جالب اینجاست که اگرچه این مدلها میتوانند باگهای بصری را تشخیص دهند، اما هنوز در تشخیصهای حساس (مثل نزدیکی اشیا) دچار خطای مثبت میشوند. در نهایت، این تحقیق پیشنهاد میدهد که فعلاً از VLMها به عنوان ابزارهای کمکی و فیلتر اولیه در فرآیند کنترل کیفیت (QA) بازیها استفاده کنیم، نه به عنوان بازرس نهایی! این یعنی هوش مصنوعی در حال تغییر دادن استانداردهای تست بازیهای ویدئویی است. 🚀
منبع: arXiv AI
