محققان به تازگی یک چارچوب جدید و هوشمند برای ارزیابی مدلهای زبانی-تصویری (VLM) معرفی کردهاند. این ابزار به مدلها اجازه میدهد بدون نیاز به دادههای مرجع (Reference-free)، کیفیت تبدیل تصاویر فلوچارت به کدهای ساختاریافته (مثل Mermaid) را در لحظه بسنجند.
این نوآوری با استفاده از ترکیب «استخراج متن» و «تطبیق بصری»، به راحتی تشخیص میدهد که آیا خروجی هوش مصنوعی دقیق است یا دچار توهم (Hallucination) شده است. این دستاورد، گامی بزرگ برای بهبود کیفیت سیستمهای تولید کد در محیطهای عملیاتی و واقعی است. 🚀
نویسی
منبع: arXiv Computer Vision
