دسته: arXiv Computer Vision (cs.CV)
-
🎨 ترکیب جادویی ترنسفورمر و دیفیوژن برای بازسازی تصاویر!
محققان در مقاله جدیدی از مدل TDiR رونمایی کردند که ترکیبی قدرتمند از معماری «ترنسفورمر» و «مدلهای دیفیوژن» است. این مدل برای حل چالشهای…
-
🛡️ ارتقای امنیت مدلهای هوش مصنوعی با رویکردی جدید: QT-AFT
محققان در مقالهای تازه، روشی نوآورانه به نام QT-AFT را معرفی کردهاند که مشکل ضعف مدلهای بینایی-زبانی (مثل CLIP) در برابر حملات خصمانه (Adversarial…
-
🚀 هوش مصنوعی در خدمت علم: معرفی FieldLVLM برای تحلیل دادههای پیچیده فیزیکی
مدلهای زبانی چندوجهی (LVLM) تا به امروز بیشتر در پردازش تصاویر و متنهای عمومی خوش درخشیدهاند، اما حالا نوبت به دنیای پیچیده علوم پایه…
-
🩺 پیشرفت چشمگیر هوش مصنوعی در تشخیص دقیقتر تصاویر سونوگرافی
محققان در مقاله جدیدی از چارچوب نوآورانه «CARE» رونمایی کردند که هدفش حل یکی از چالشهای بزرگ در پردازش تصاویر پزشکی است: «درهمتنیدگی بافتها».…
-
🎨 خداحافظی با رنگهای اشتباه در تولید تصویر با هوش مصنوعی!
حتماً برای شما هم پیش آمده که از مدلهای هوش مصنوعی بخواهید رنگ دقیقی مثل «آبی تیفانی» یا «صورتی جیغ» را تولید کنند، اما…
-
🔍 ابداع روشی جدید برای درک محیط با استفاده از رادار و هوش مصنوعی
محققان در پروژه RISE، راهکار جذابی برای درک فضای داخلی ساختمانها معرفی کردهاند. این سیستم با استفاده از رادارهای موج میلیمتری (mmWave)، میتواند بدون…
-
🚀 جهش در درک سهبعدی با معماری DM3D؛ هوش مصنوعی دقیقتر از همیشه!
محققان به تازگی مدل جدیدی به نام DM3D را معرفی کردهاند که تحولی در نحوه درک مدلهای هوش مصنوعی از فضاهای سهبعدی ایجاد میکند.…
-
🚀 جهش در تولید ویدیو با هوش مصنوعی: معرفی SSVAE
اگر در حوزه تولید ویدیو با مدلهای دیفیوژن فعالیت میکنید، خبر خوبی برایتان داریم! محققان به تازگی با تحلیل فضای نهفته (Latent Space) ویدیوها،…
-
🔍 پدیده «سراب سهبعدی» در مدلهای بینایی ماشین؛ چالش جدید دقت مدلها!
محققان در مطالعه اخیر خود به یک ضعف مهم در مدلهای «تخمین عمق» (Monocular Depth) پی بردند. این مدلها که بر اساس تصاویر دوبعدی،…
-
🚀 جهش بزرگ در هوش مصنوعی برای خودروهای خودران!
محققان با معرفی مجموعه داده جدید «DeepUrban»، گامی بلند برای حل یکی از بزرگترین چالشهای رانندگی خودکار برداشتهاند. این پروژه که با همکاری DeepScenario…