محققان بهتازگی بنچمارک جدیدی به نام «ClinLens» را معرفی کردهاند که توانایی مدلهای هوش مصنوعی را در تحلیل دادههای پیچیده پزشکی (مانند سوابق الکترونیک بیمار، نوار قلب و تصاویر رادیولوژی) به چالش میکشد.
نتایج اولیه این تحقیق نشان میدهد که با وجود پیشرفتهای چشمگیر، هنوز شکاف بزرگی بین «کدنویسیِ موفق» توسط مدلها و «تحلیل بالینیِ صحیح» وجود دارد. در واقع، بسیاری از مدلها میتوانند کد اجرا کنند، اما در رسیدن به نتیجه درمانی دقیق ناتواناند. این دستاورد گامی مهم برای ایمنتر کردن هوش مصنوعی در محیطهای بیمارستانی است. 🩺💻
منبع: arXiv AI
