محققان در پژوهشی جدید، یک مجموعه داده چندوجهی (Multimodal) برای گزارشهای پزشکی PET/CT به زبان ویتنامی ایجاد کردهاند. چالش اصلی مدلهای فعلی هوش مصنوعی پزشکی، تمرکز بر زبانهای رایج و کمبود دادههای تصویری تخصصی است.
این پروژه شامل ۲۷۵۷ اسکن کامل بدن همراه با گزارشهای بالینی است که به بهبود دقت مدلهای Vision-Language در تشخیصهای پزشکی کمک شایانی میکند. این دستاورد نشان میدهد چگونه میتوان با دادههای تخصصی، شکافهای زبانی و فنی را در دنیای پزشکی هوشمند پر کرد. 🏥✨
منبع: arXiv Computer Vision
