تازه چه خبر؟ محققان در یک تحقیق انتقادی جدید، نگاهی به ۲۷ مقاله علمی در حوزه تشخیص «پولیپ کولون» توسط هوش مصنوعی انداختند و به نتایج جالبی رسیدند! 🧬
مشکل کجاست؟
این پژوهش نشان داده که بسیاری از مدلهای هوش مصنوعی پزشکی، در عمل با استانداردهای غیردقیق ارزیابی میشوند:
۱. عدم استفاده از معیارهای کلیدی مثل «فاصله هاسدورف» برای تشخیص ضایعات کوچک.
۲. استفاده از پروتکلهای آموزشی متفاوت که عملاً مقایسه مدلها را غیرممکن میکند.
۳. فقدان تستهای آماری معتبر در ۹۶٪ مقالات بررسی شده!
این یعنی حتی اگر عددی در یک جدول عملکرد مدلهای پزشکی میبینید، ممکن است صرفاً یک سراب باشد تا پیشرفت واقعی! این هشدار مهمی است که یادآوری میکند هوش مصنوعی در پزشکی نیازمند سختگیریهای علمی بسیار بیشتری است. 🏥💡
منبع: arXiv Computer Vision
