محققان در یک مطالعه جدید، روشی نوآورانه برای «ممیزی» استفاده از شواهد توسط مدلهای زبانی (LLM) در تشخیصهای پزشکی ابداع کردهاند. مشکل اینجاست که دقتِ صرف در تشخیص، نشاندهنده هوشمندی مدل نیست؛ چرا که ممکن است مدل شواهد بیمار را به درستی درک نکند.
این تحقیق با بررسی ۵ مدل بزرگ زبانی روی مجموعهدادههای مختلف، نشان میدهد که بسیاری از تعاملات هوش مصنوعی در تشخیص بیماری، منطقی و قابل دفاع است، اما در برخی موارد با «خطاهای میانبر» یا نادیده گرفتن شواهد ظریف روبرو هستیم. این دستاورد گامی حیاتی برای ایمنتر کردن استفاده از AI در مراکز درمانی است. 🩺🏥
منبع: arXiv AI
