محققان در تلاش برای بهبود دقت هوش مصنوعی در دنیای پزشکی، بنچمارک جدیدی به نام Medical-Checklist را معرفی کردهاند. 🩺💻
چالش اصلی مدلهای فعلی این است که گاهی در درک جزئیات تصاویر پزشکی و تطبیق آنها با متن دچار خطا میشوند. این معیار جدید با استفاده از تستهای دوتایی (مقایسه کپشن صحیح و غلط)، دقت مدلها را در درک مفاهیم تخصصی پزشکی و مواجهه با دادههای خارج از توزیع (Out-of-distribution) محک میزند.
این ابزار میتواند گامی مهم برای افزایش اطمینان پزشکان به تشخیصهای هوش مصنوعی باشد. 🏥💡
منبع: arXiv Computer Vision
