دسته: arXiv Computer Vision (cs.CV)
-
🧠 جهش در قدرت استدلال بصری هوش مصنوعی با ابزار جدید Trace
محققان به تازگی از یک چارچوب نوآورانه به نام Trace رونمایی کردهاند که تحولی در آموزش مدلهای بینایی-زبانی (Vision-Language Models) ایجاد کرده است. تا…
-
🚀 بهینهسازی خیرهکننده SAM2 با Lean-SAM2!
مدل محبوب Segment Anything 2 (SAM2) که در حوزه بخشبندی تصاویر و ویدیوها انقلابی به پا کرده بود، حالا با مدل جدید Lean-SAM2 سبکتر…
-
🚀 گامی بزرگ در تحلیل هوشمند ویدیو؛ معرفی مدل MoAKE
آیا هوش مصنوعی میتواند مثل یک داور حرفهای، کیفیت اجرای حرکات ورزشی یا هر فعالیت دیگری را در یک ویدیوی کوتاه تحلیل کند؟ 🎥…
-
🚀 تحول در بخشبندی تصاویر پزشکی با هوش مصنوعی؛ بدون نیاز به آموزش اضافه!
محققان در مقاله جدیدی، چارچوب نوآورانهای را معرفی کردهاند که میتواند دقت بخشبندی (Segmentation) دادههای حجیم پزشکی را بدون نیاز به آموزش مدلهای سنگین…
-
🚀 تلفیق نوآورانه هوش مصنوعی و شبکههای عصبی اسپایکی (SNN) برای پردازش تصاویر
محققان در مقالهای جدید، متد انقلابی «CIS-Fuse» را معرفی کردند که دنیای ترکیب تصاویر مادون قرمز و مرئی را متحول میکند! برخلاف شبکههای عصبی…
-
🔥 تحولی در تشخیص چهره با هوش مصنوعی: معرفی MTVDiff
محققان موفق به توسعه مدل جدیدی به نام MTVDiff شدند که چالشهای تبدیل تصاویر حرارتی به تصاویر مرئی (Thermal-to-Visible) را به شکل چشمگیری حل…
-
🤖 جراحی هوشمند با دقت میلیمتری؛ معرفی مدل LAViFiT
پیشرفتهای دنیای پزشکی و هوش مصنوعی تمامی ندارد! محققان به تازگی چارچوب جدیدی به نام LAViFiT معرفی کردهاند که به رباتهای جراح کمک میکند…
-
🧠 هوش مصنوعی در خدمت تشخیص سکته مغزی: سبکتر و سریعتر!
محققان با معرفی فریمورک جدید StrokeSeg2، گام مهمی در کاربردی کردن مدلهای سنگین تشخیص ضایعات مغزی در محیطهای بالینی برداشتهاند. مشکل اصلی مدلهای پیشرفته…
-
📊 معرفی MV-Bench: استانداردی جدید برای ارزیابی مدلهای هوش مصنوعی در طراحی رابط کاربری
مدلهای زبانی چندوجهی (MLLM) روز به روز در حال پیشرفت هستند، اما همچنان در ساخت رابطهای کاربری پیچیده و چندمنظوره با چالش روبهرواند. محققان…
-
🚀 تحولی در ردیابی خودروها با هوش مصنوعی؛ معرفی LoRFT
آیا هوش مصنوعی میتواند به دوربینهای بزرگراه کمک کند تا مسیر حرکت خودروها را حتی در فواصل دور و نقاط کور با دقت بالا…