محققان در تازهترین دستاورد خود برای بهبود بینایی ماشین در حوزههای تخصصی، مدل جدید و مجموعه دادهای به نام «MarineEVT» را معرفی کردهاند.
این ابزار هوشمند با استفاده از تکنیکهای استدلالی و ابزارهای بصری (Visual Tool Reasoning)، مشکل تحلیل ویدیوهای دریایی را حل کرده است. از آنجایی که وقایع در اعماق دریا معمولاً پراکنده و غیرقابلپیشبینی هستند، مدلهای معمولی در درک آنها دچار خطا میشوند، اما MarineEVT با تمرکز بر این رویدادهای خاص، توانسته عملکرد مدلهای بینایی-زبانی (VLM) را تا حد چشمگیری افزایش دهد.
این پژوهش که بر روی ۲۰ هزار نمونه ویدیویی آموزش دیده، در مقایسه با مدلهای تجاری مطرح، دقت بسیار بالاتری را در تحلیل محیطهای آبی از خود نشان داده است. این یعنی گام بزرگی برای اکتشافات زیردریایی و مطالعات محیطزیستی با کمک هوش مصنوعی! 🐋🤿
منبع: arXiv Computer Vision
