تصور کنید پزشکان بتوانند حین جراحی یا معاینه، با استفاده از عینکهای هوشمند، دقیقترین تحلیلها را از تصاویر پزشکی دریافت کنند. محققان به تازگی سیستم چندعاملی (Multi-agent) جدیدی به نام «EgoMed-Agent» را معرفی کردهاند که تحولی در بخشبندی (Segmentation) تصاویر پزشکی از دیدگاه اولشخص (Egocentric) ایجاد میکند.
چالش اصلی در این حوزه، ابهامات معنایی و تغییرات بصری در ویدیوهای ضبط شده توسط پزشک بود که این سیستم با دو نوآوری کلیدی حل کرده است:
✅ جریان تأیید هدف: برای اطمینان از اینکه هوش مصنوعی دقیقاً به همان عضو مدنظر پزشک توجه میکند.
✅ جریان انتشار هدایتشده: برای حفظ ثبات ماسک تصویر، حتی با وجود لرزش یا حرکت سر پزشک.
نتایج آزمایشها خیرهکننده است؛ این سیستم به دقت خیرهکننده ۷۱.۳۴٪ دست یافته که فاصله زیادی با مدلهای قبلی دارد. گام بزرگی برای دستیار هوشمند جراحان در آینده! 🚀
منبع: arXiv Computer Vision
