🏥 هوش مصنوعی در اتاق عمل؛ مدل‌های زبانی در آزمون تشخیص زخم‌های بالینی

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

آیا هوش مصنوعی می‌تواند مثل یک پزشک متخصص زخم‌ها را تحلیل کند؟ محققان در مطالعه‌ای جدید، عملکرد چندین مدل پیشرفته (مثل ChatGPT، Claude، و مدل‌های تخصصی پزشکی مثل MedGemma) را روی تصاویر واقعی و متنوع از زخم‌ها بررسی کردند.

نتایج این ارزیابی جالب است:
✅ مدل‌های عمومی مثل ChatGPT و Claude با اختلاف زیادی در تحلیل‌های بالینی از مدل‌های تخصصی پزشکی پیشی گرفتند.
✅ هوش مصنوعی در تشخیص مواردی مثل ریسک عفونت و برنامه‌ریزی درمانی عملکرد قابل قبولی نشان داده است، هرچند هنوز تا دقت کامل فاصله دارد.

این تحقیق نشان می‌دهد که دنیای «مدل‌های چندوجهی» (VLM) با سرعت در حال ورود به حوزه‌های حساس پزشکی است و می‌تواند در آینده دستیار قدرتمندی برای پزشکان باشد. نظر شما چیست؟ آیا به تشخیص‌های هوش مصنوعی در امور پزشکی اعتماد دارید؟

منبع: arXiv Computer Vision