محققان در پژوهشی جدید، نقش حیاتی «عمق» (Depth) را در مدلهای بینایی ماشین (Foundation Models) برای حوزه جراحی بررسی کردند. نتایج خیرهکننده است: برخلاف مدلهای فعلی که فقط از تصاویر دوبعدی (RGB) استفاده میکنند، اضافه کردن اطلاعات عمق (RGB-D) در مرحله پیشآموزش، باعث میشود مدلها با تنها ۲۵٪ دادههای برچسبگذاری شده، عملکردی بهتر از مدلهای معمولی داشته باشند.
این یعنی در آیندهای نزدیک، رباتهای جراح نه تنها تصاویر را میبینند، بلکه درک سهبعدی دقیقتری از محیط حساس بدن بیمار خواهند داشت که به معنای دقت بالاتر و ایمنی بیشتر است! 🧠✨
منبع: arXiv Computer Vision
