محققان در پژوهشی جدید، چالش جالبی را در مدلهای هوش مصنوعی پزشکی شناسایی کردهاند: گاهی اوقات مدلها به سوالات پیچیده پزشکی پاسخ درست میدهند، اما در تحلیل جزئیات (سوالات اتمی) دچار تناقض میشوند!
برای حل این مشکل، بنچمارک جدیدی به نام EndoCA معرفی شده که سازگاری مدلها در پاسخدهی چندمرحلهای را میسنجد. همچنین تکنیک نوآورانه ASR به مدلها کمک میکند تا با تکیه بر پاسخهای اتمی صحیح، خطای خود را اصلاح کرده و در موارد مشکوک، هوشمندانه از پاسخدهی خودداری کنند تا خطای پزشکی کاهش یابد.
این یعنی قدمی بزرگتر برای اعتماد به هوش مصنوعی در تشخیصهای حساس پزشکی! 🩺✨
منبع: arXiv AI
