محققان به تازگی مدل جدیدی به نام TrajLoc معرفی کردهاند که انقلابی در «مکانیابی جغرافیایی متقاطع» (Cross-view Geo-localization) ایجاد میکند.
تا امروز مدلها بیشتر روی تصاویر ثابت متمرکز بودند، اما TrajLoc میتواند با تحلیل همزمان ویدیوها و دستورالعملهای متنی (مثل مسیرهای حرکتی)، موقعیت دقیق را حتی در محیطهای پیچیده شناسایی کند.
این مدل با استفاده از یک مجموعه داده عظیم ۳۹ هزار تایی (SeqGeo-VL)، درک هوش مصنوعی از هندسه مسیر و موقعیتهای جغرافیایی را به شدت بهبود بخشیده است. این دستاورد میتواند آیندهی خودروهای خودران و سیستمهای ناوبری هوشمند را متحول کند. 📍🚗
منبع: arXiv Computer Vision
