🔍 چرا رتبه‌بندی‌های هوش مصنوعی همیشه قابل اعتماد نیستند؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

تا حالا فکر کردید چرا یک مدل هوش مصنوعی در یک بنچ‌مارک عالی عمل می‌کند اما در دنیای واقعی دچار خطا می‌شود؟ محققان در مطالعه جدید خود نشان دادند که رتبه‌بندی «آشکارسازهای خارج از توزیع» (OOD Detectors) در مدل‌های بینایی-زبانی (VLM) با تغییر دامنه داده‌ها کاملاً جابجا می‌شود.

نکته جالب اینجاست که هیچ آشکارساز واحدی در همه سناریوها بهترین نیست. به همین دلیل، محققان ابزار جدیدی به نام CEG (مخفف Complementary Evidence Guard) را معرفی کرده‌اند که با ترکیب هوشمندانه شاخص‌های «سطح» و «تیزی» (Sharpness)، خطاهای تشخیص در مدل‌ها را به شکل چشمگیری کاهش می‌دهد.

این تحقیق گامی مهم برای افزایش دقت و پایداری سیستم‌های هوش مصنوعی در محیط‌های واقعی است.

منبع: arXiv Computer Vision