دسته: arXiv Computer Vision (cs.CV)
-
🌳 هوش مصنوعی و مدلسازی دقیق درختان؛ معرفی TreeSRNF
محققان در تازهترین پژوهش خود سراغ مدلسازی پیچیده ساختارهای درختی رفتهاند. مدل جدیدی به نام TreeSRNF معرفی شده که میتواند به شکلی خیرهکننده، هندسه…
-
🔍 خواندن متون در تصاویر با دقت بالاتر؛ معرفی روش 2D-RoPE-STR
تکنولوژی تشخیص متن در تصاویر (Scene Text Recognition) همیشه با چالشهایی مثل چرخش متن یا پرسپکتیوهای پیچیده روبرو بوده است. مدلهای ترنسفورمر فعلی اغلب…
-
🎬 تحولی در کیفیت ویدیوها با هوش مصنوعی؛ معرفی LPM
آیا تا به حال به این فکر کردید که چطور ویدیوهای بیکیفیت و قدیمی به صورت حرفهای بازسازی میشوند؟ محققان مدل جدیدی به نام…
-
🏗️ خلق صحنههای سهبعدی با جزئیات خیرهکننده: معرفی HIVE-3D
تولید مدلهای سهبعدی از یک تصویر واحد همیشه با محدودیت رزولوشن همراه بوده، اما حالا مدل جدید HIVE-3D این چالش را هدف قرار داده…
-
🎵 تجربهای متفاوت از موسیقی؛ خلق ویدیوهای ۳۶۰ درجه با هوش مصنوعی
محققان در جدیدترین پژوهش خود، مدل خلاقانهای به نام Bring Music The Horizon معرفی کردهاند که دنیای گوش دادن به موسیقی را متحول میکند.…
-
🚀 تحولی در درک سهبعدی محیط با مدل GPOcc++
محققان در جدیدترین دستاورد خود، مدل GPOcc++ را معرفی کردهاند که گامی بزرگ برای هوش مصنوعی در حوزه درک محیطهای سهبعدی است. این مدل…
-
🏗 بازسازی دقیقتر سطوح سهبعدی با تکنولوژی CASA-SDF
مدلهای سهبعدی معمولاً در محیطهای پیچیده دچار نقصهایی مثل صاف شدن بیش از حد لبهها یا جزئیات ضعیف میشوند. محققان به تازگی مدل CASA-SDF…
-
🔍 دقت بیشتر در دنیای سهبعدی؛ معرفی مدل M2P-AD
تکنولوژی تشخیص ناهنجاری (Anomaly Detection) در محیطهای سهبعدی هر روز کاربردیتر میشود، اما چالشهایی مثل خطای تشخیص در لبههای اشیاء یا نویز در مناطق…
-
🚀 بهینهسازی خیرهکننده در مدلهای بینایی-زبانی: معرفی روش جدید کاهش توکن
مدلهای بزرگ بینایی-زبانی (VLM) اگرچه بسیار قدرتمند هستند، اما به دلیل حجم بالای توکنهای بصری، اجرای آنها روی دستگاههای موبایل یا لبه (Edge Devices)…
-
🔍 کشف هوشمند دستهبندیها؛ معرفی مدل DP-BOA
آیا هوش مصنوعی میتواند در لحظه تصمیم بگیرد که یک داده جدید به دستههای قبلی تعلق دارد یا باید یک دسته جدید برایش تعریف…