دسته: arXiv Computer Vision (cs.CV)
-
🌱 ارتقای دقت کشاورزی هوشمند با ابزارهای مبتنی بر هوش مصنوعی
محققان در پژوهشی جدید، راهکار هوشمندانهای برای پاکسازی دادههای حجیمِ کشاورزی معرفی کردهاند. یکی از بزرگترین چالشهای نقشهبرداری از محصولات کشاورزی در مقیاس جهانی،…
-
🚀 جهشی بزرگ در ادراک خودروهای خودران با SimBEV2X
توسعه سیستمهای خودروهای هوشمند (V2X) به دلیل کمبود دادههای جامع همیشه با چالش روبرو بوده است. حالا محققان ابزار جدیدی به نام SimBEV2X را…
-
👁️ هوش مصنوعی که «نگاه» شما را میخواند: معرفی Gazette
محققان در تازهترین دستاورد خود، مدل جدیدی به نام «Gazette» را معرفی کردهاند که میتواند حرکات چشم (Gaze) را به متنهای توصیفی تبدیل کند!…
-
🎨 هوش مصنوعی در نقش یک هنرمند احساسی؛ معرفی EmoScope!
ویرایش تصاویر فراتر از فیلترهای ساده! محققان به تازگی چارچوب هوشمند «EmoScope» را معرفی کردهاند که به جای استفاده از قالبهای ثابت و تکراری،…
-
🚀 جهش در درک هوشمند تصاویر با مدل DDVT
آیا هوش مصنوعی میتواند مثل یک انسان به تصاویر دقیق نگاه کند و به سوالات ما درباره جزئیات آنها پاسخ دهد؟ محققان به تازگی…
-
🚀 تحولی در تشخیص ناهنجاریها: معرفی DuoAD بدون نیاز به آموزش!
محققان در تازهترین مقاله خود، فریمورک قدرتمند «DuoAD» را معرفی کردهاند که دنیای «تشخیص ناهنجاری» (Anomaly Detection) را دگرگون میکند. این مدل با بهرهگیری…
-
🎨 رفع مشکل «تکراری بودن» تصاویر در مدلهای دیفیوژن با متد جدید MoNO
مدلهای هوش مصنوعی که تصاویر را سریع تولید میکنند (Distilled Diffusion Models)، گاهی اوقات دچار مشکل یکنواختی میشوند و خروجیهای مشابهی تولید میکنند. اما…
-
🎥 تحول در درک ویدیو با TimePLE: وقتی هوش مصنوعی زمان را بهتر میفهمد!
محققان در تازهترین پژوهش خود، مدل جدیدی به نام «TimePLE» را معرفی کردهاند که انقلابی در زمینه «زمینیسازی زمانی ویدیو» (Video Temporal Grounding) ایجاد…
-
🚀 جهشی جدید در دقت پردازش ابر نقاط (Point Clouds) با روش RODR
محققان در تازهترین دستاورد خود، متد جدیدی به نام «RODR» معرفی کردهاند که مشکل رایج «تداخل گرادیان» در مدلهای هندسی را حل میکند. این…
-
🛡️ هوش مصنوعی به کمک امنیت خودروهای خودران میآید: مقابله با حملات اسپوفینگ GNSS
آیا تا به حال به امنیت مسیریابی در خودروهای خودران فکر کردهاید؟ محققان بهتازگی راهکار هوشمندانهای با استفاده از «مدلهای بینایی-زبانی» (VLM) توسعه دادهاند…