🏥 آیا هوش مصنوعی در پزشکی واقعاً می‌داند به چه چیزی نگاه می‌کند؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در یک پژوهش تازه، چالش بزرگی را در مدل‌های بینایی-زبانی (VLM) برای کاربردهای پزشکی کشف کرده‌اند. با وجود پیشرفت‌های اخیر در GPT-5 و Gemini، نتایج نشان می‌دهد که این مدل‌ها در «مکان‌یابی دقیق» شواهد پزشکی (مثلاً محل دقیق یک ضایعه در عکس رادیولوژی) بسیار ضعیف عمل می‌کنند.

جالب‌تر اینکه، برخلاف تصور رایج، محدود کردن مدل به یک محدوده خاص (Cropping) نه تنها دقت را بالا نمی‌برد، بلکه به دلیل حذف بافت کلی تصویر، عملکرد پاسخ‌دهی مدل را کاهش می‌دهد! این مطالعه نشان می‌دهد که برای استفاده بالینی از هوش مصنوعی، هنوز راه درازی تا رسیدن به «شفافیت و قابلیت اعتماد» (Auditability) داریم.

منبع: arXiv AI