محققان در مطالعه جدیدی به یک نکته حیاتی در مدلهای پزشکی پرداختهاند. در بسیاری از سیستمهای هوش مصنوعی (مانند بخشبندی تصاویر MRI ستون فقرات)، به دلیل هزینهی بالای برچسبگذاری توسط متخصصان (Gold Labels)، از برچسبهای تولید شده توسط ماشین (Silver Labels) استفاده میشود.
نتایج این تحقیق نشان میدهد که این کار میتواند «توهم دقت» ایجاد کند. در واقع، مدلها به جای یادگیری از واقعیتِ پزشکی، با برچسبهای ناقص همسو میشوند که این موضوع منجر به خطاهای سیستماتیک و نادیده گرفتنِ عدالت (Fairness) در گروههای سنی و جنسیتی مختلف میشود. این پژوهش زنگ خطری است برای توسعهدهندگان که برای ارزیابی دقیق، همیشه به برچسبهای طلاییِ متخصصان تکیه کنند. 🩺🤖
منبع: arXiv Computer Vision
