دسته: arXiv Computer Vision (cs.CV)
-
📐 تحولی جدید در تخمین دقیق موقعیت اشیاء با هوش مصنوعی (TriCons-Pose)
محققان به تازگی چارچوب جدیدی به نام «TriCons-Pose» معرفی کردند که دقت تخمین موقعیت اشیاء در فضا (Object Pose Estimation) را به شکل چشمگیری…
-
🚀 افزایش چشمگیر سرعت مدلهای بینایی-زبانی با روش نوین SpecFlow!
یکی از چالشهای اصلی مدلهای VLM، هزینه بالای پردازش توکنهای بصری طولانی است. حالا محققان روشی به نام «SpecFlow» معرفی کردهاند که بدون نیاز…
-
🎨 تحولی بزرگ در تولید مدلهای سهبعدی با هوش مصنوعی!
محققان مدل جدیدی به نام LATO.2 را معرفی کردهاند که دنیای تولید مدلهای سهبعدی (3D Mesh) را دگرگون میکند. تا پیش از این، مدلهای…
-
🚀 انقلابی در نقشهبرداری سهبعدی و واقعیت مجازی با هوش مصنوعی!
معرفی «AnythingReality»؛ سیستمی هوشمند که دنیای اطراف شما را در لحظه به فضای سهبعدی تبدیل میکند. این فناوری با استفاده از Gaussian Splatting و…
-
🚀 تحولی در بازیابی هوشمند تصاویر؛ معرفی HashViT
محققان در یک مقاله جدید، معماری خلاقانهای به نام «HashViT» را برای بهبود بازیابی تصاویر در مقیاس بزرگ معرفی کردهاند. مشکل روشهای فعلی این…
-
🎥 انقلابی در تولید ویدئو؛ معرفی مدل Vidu S1
دنیای تولید ویدئو با هوش مصنوعی باز هم شگفتزدهمان کرد! مدل جدید Vidu S1 بهتازگی معرفی شده که امکان تولید ویدئوی تعاملی و بینهایت…
-
🧠 پیشرفت خیرهکننده هوش مصنوعی در درک ساختار مغز!
دانشمندان به تازگی مدل بنیادی جدیدی به نام BrainFIBRE را معرفی کردهاند که میتواند با تحلیل دادههای اسکن مغزی (MRI)، اطلاعات بسیار دقیقی از…
-
🚀 تحولی در پردازش تصویر با دوربینهای رویداد (Event Cameras)!
محققان به تازگی فریمورک نوآورانهای برای «حذف نویز حرکتی» (Motion-aware Event Suppression) در دوربینهای رویداد معرفی کردهاند که میتواند دنیای بینایی ماشین را دگرگون…
-
🚗 تحولی بزرگ برای خودروهای خودران: معرفی دیتاست عظیم IEDD! 🤖
محققان به تازگی مجموعه داده جدید و بسیار کاربردی به نام «IEDD» را معرفی کردهاند که میتواند انقلابی در آموزش مدلهای بینایی-زبانی-عملگر (VLA) برای…
-
🛰️ انقلابی در تحلیل تصاویر ماهوارهای با هوش مصنوعی!
محققان در مطالعهای جدید، روشی نوآورانه برای آموزش مدلهای پایه در حوزه «رصد زمین» (Earth Observation) ارائه کردهاند. مدلهای فعلی اغلب در یکپارچهسازی انواع…