مدلهای چندوجهی (Vision-Language) در حوزه پزشکی اغلب به جای تحلیل دقیق تصاویر، به کلیشههای متنی تکیه میکنند که میتواند خطرناک باشد. محققان با معرفی متد جدید Med-OPD، فریمورکی ابداع کردهاند که به مدل کمک میکند روی «شواهد بصری حیاتی» تمرکز کند.
این متد با استفاده از تکنیک جدیدی به نام «مزیت شواهد پزشکی» (MEA)، یادگیری مدل را دقیقتر کرده و باعث میشود تشخیصهای بالینی بر اساس دادههای تصویری واقعی باشد، نه فقط حدسیات زبانی. گامی مهم برای افزایش اعتماد به تشخیصهای پزشکیِ مبتنی بر هوش مصنوعی! 🩺✨
منبع: arXiv AI
