تخمین عمق در محیطهای پیچیده با دوربینهای فیشآی (Fisheye) همیشه یک چالش بزرگ بوده، اما محققان با معرفی مدل OmniDS گام بزرگی برای حل این مشکل برداشتهاند.
این مدل جدید با ترکیب یک استراتژی هوشمندانه (ترکیب CNN سبک برای جزئیات هندسی و DINOv3 برای درک معنایی)، بهجای استفاده از روشهای قدیمی و سختگیرانه، از «فیوژن کانتکست پویا» و مکانیزم توجه (Attention) بهره میبرد. نتیجه کار؟ خروجی سهبعدی بسیار دقیقتر در محیطهای مختلف و مهمتر از همه، امکان پیادهسازی بهینه روی موبایل!
این فناوری میتواند تحولی در مسیریابی روباتها و خودروهای خودران ایجاد کند که به دید ۳۶۰ درجه نیاز دارند. 🚀
منبع: arXiv Computer Vision
