📊 ارزیابی دقیق‌تر هوش مصنوعی: تبدیل فلوچارت به کد با دقت بالا

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان به تازگی یک چارچوب جدید و هوشمند برای ارزیابی مدل‌های زبانی-تصویری (VLM) معرفی کرده‌اند. این ابزار به مدل‌ها اجازه می‌دهد بدون نیاز به داده‌های مرجع (Reference-free)، کیفیت تبدیل تصاویر فلوچارت به کدهای ساختاریافته (مثل Mermaid) را در لحظه بسنجند.

این نوآوری با استفاده از ترکیب «استخراج متن» و «تطبیق بصری»، به راحتی تشخیص می‌دهد که آیا خروجی هوش مصنوعی دقیق است یا دچار توهم (Hallucination) شده است. این دستاورد، گامی بزرگ برای بهبود کیفیت سیستم‌های تولید کد در محیط‌های عملیاتی و واقعی است. 🚀

‌نویسی

منبع: arXiv Computer Vision