تا به حال مدلهای هوش مصنوعی در درک «مفهوم» از طریق مثالهای تصویری مشکل داشتند، اما با معرفی متد جدید VICIS، این سد شکسته شد!
محققان در این پژوهش جدید، مدلی را توسعه دادهاند که میتواند با دیدن مجموعهای از تصاویر که یک مفهوم مشترک دارند، آن مفهوم را یاد بگیرد و در تصاویر جدید اعمال کند. برخلاف مدلهای فعلی که اغلب در استدلال بصری ضعیف هستند، این معماری قادر است خروجیهای دقیقتر و متنوعتری تولید کند و حتی مفاهیم دیده نشده (مثل اسکچ یا طراحیهای دستی) را هم درک کند. این یک جهش بزرگ برای کاربردهای خلاقانه و تحلیلهای هوشمند در دنیای بینایی ماشین است. 🧠🎨
منبع: arXiv Computer Vision
