🏥 چالش جدید در هوش مصنوعی پزشکی: آیا مدل‌ها واقعاً در تشخیص بیماری‌ها قابل اعتمادند؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان در پژوهشی جدید، بنچمارک دقیق و تازه‌ای به نام «MamaBench» را معرفی کرده‌اند که عملکرد مدل‌های زبانی بزرگ (LLM) را در حوزه سلامت مادر و کودک به چالش می‌کشد. 🩺

نکته جالب اینجاست که این تحقیق نشان می‌دهد حتی مدل‌های قدرتمند هم گاهی اوقات در تشخیص‌های بالینی مشابه دچار سردرگمی می‌شوند و به اصطلاح «شکست در منطق معکوس» دارند. تیم پژوهشی برای حل این مشکل، تکنیک جدیدی به نام «EA-RAG» را پیشنهاد داده‌اند که با بهبود بازیابی اطلاعات پزشکی، دقت و پایداری مدل‌ها را به شکل چشمگیری افزایش می‌دهد.

این تحقیق گام مهمی برای رسیدن به هوش مصنوعیِ امن‌تر و دقیق‌تر در محیط‌های حساس درمانی است. 🤖💡

منبع: arXiv Machine Learning