محققان در مطالعهای جدید به چالش مهمی در مدلهای چندوجهی (VLM) حوزه پزشکی پرداختهاند. یافتهها نشان میدهد که بسیاری از این مدلها به جای «دیدن» و تحلیل تصاویر پاتولوژی، صرفاً با تکیه بر اطلاعات متنی و میانبرهای زبانی پاسخ میدهند!
برای حل این مشکل، بنچمارک جدیدی به نام «PathBind» معرفی شده که با ارزیابی دقیقترِ ارتباط بین تصویر و متن، به ما کمک میکند بفهمیم هوش مصنوعی چقدر در تشخیصهای پزشکی واقعاً به تصاویر تکیه میکند. گام مهمی برای افزایش دقت و اعتماد در تشخیصهای پزشکی خودکار! 🧬🔬
منبع: arXiv Computer Vision
