مدلهای زبانی چندوجهی (LVLM) در دنیای پزشکی به شدت کاربردی شدهاند، اما استفاده همزمان از چندین مدل متخصص، هزینههای محاسباتی سنگینی دارد. محققان با معرفی بنچمارک جدیدی به نام «MergeMedBench»، روشی نوآورانه به اسم Winner-Take-All را پیشنهاد دادهاند.
در این روش، بهجای ترکیب ساده مدلها که باعث کاهش دقت میشود، فقط پارامترهای اصلی و کلیدی حفظ میشوند. این یعنی داشتن یک مدل واحد، سبک و در عین حال متخصص برای تحلیل تصاویر پزشکی مختلف که کار را برای پزشکان و متخصصان بسیار سادهتر میکند.
منبع: arXiv Computer Vision
