محققان در مطالعهای جذاب موفق شدند بفهمند که مدلهای بینایی-زبانی (VLM) چگونه یافتههای پزشکی را در تصاویر سهبعدی CT درک میکنند.
برخی از نکات کلیدی این پژوهش:
🔹 کشف «کانالهای مفهومی تنک»: هر تشخیص رادیولوژیکی توسط تعداد محدودی از لایههای عصبی مدل رمزگذاری میشود.
🔹 کارایی بالا: با حذف این کانالهای خاص، دقت مدل در آن مورد خاص از بین میرود، اما سایر تشخیصها دستنخورده باقی میمانند!
🔹 سرعت و دقت فوقالعاده: روش جدید معرفی شده (CCP) در مقایسه با روشهای قبلی، ۲۲ برابر سریعتر عمل کرده و نتایج بالینی بسیار دقیقتری ارائه میدهد.
این دستاورد راه را برای ایجاد هوش مصنوعیِ پزشکیِ قابلتفسیرتر و کارآمدتر هموار میکند. 🚀
منبع: arXiv AI
