دسته: arXiv Computer Vision (cs.CV)
-
🎥 تحولی جدید در ساخت پرترههای متحرک با STARCaster
محققان در تازهترین مقاله خود از مدل نوآورانهای به نام STARCaster رونمایی کردند که میتواند پرترههای متحرک بسیار واقعگرایانه بسازد. این مدل با ترکیب…
-
🚀 جهش در کیفیت تصویرسازی با مدلهای هوش مصنوعی! 🎨
محققان در مقاله جدیدی از فریمورک نوآورانه «REGLUE» رونمایی کردند که هدفش حل مشکل «درک معنایی» در مدلهای انتشار (Diffusion Models) است. تا پیش…
-
📐 چرا مدلهای سهبعدی هوش مصنوعی در درک «تقارن» ضعف دارند؟
محققان در پژوهش جدیدی به سراغ یکی از نقاط ضعف جدی مدلهای تولیدکننده تصاویر و اشیاء سهبعدی رفتهاند: «تقارن». برخلاف انتظار، مدلهای فعلی با…
-
🔍 هوش مصنوعی در خدمت محیطزیست: معرفی FusionNet
محققان با معرفی مدل جدیدی به نام FusionNet، گام بزرگی در پایش دقیقتر آلایندگی صنایع برداشتهاند. این مدل با ترکیب دادههای چندطیفی (Multi-spectral) و…
-
🚀 جهشی نو در تولید تصویر با هوش مصنوعی: معرفی مدل CACFM
محققان در مقاله جدیدی، متد «Curvature-Adaptive Consistency Flow Matching» یا به اختصار CACFM را معرفی کردند که دنیای مدلهای دیفیوژن (مانند FLUX و SDXL)…
-
💇♂️ مدل جدید H-Adapter؛ انقلابی در تغییر مدل مو با هوش مصنوعی!
حتماً برای شما هم پیش آمده که بخواهید در یک عکس، مدل موی خود را عوض کنید اما زاویه سر یا ژست تصویر اجازه…
-
🚀 بهینهسازی دقیقتر تصاویر با هوش مصنوعی؛ معرفی TaskTok
محققان در مقاله جدیدی از فریمورک نوآورانه «TaskTok» رونمایی کردند. تا پیش از این، مدلهای بازیابی تصویر سعی میکردند تمام جزئیات را تغییر دهند…
-
🎨 انقلابی در بازسازی سهبعدی با هوش مصنوعی: معرفی SubdivAR
محققان مدل جدیدی به نام SubdivAR را معرفی کردهاند که دنیای گرافیک سهبعدی و مدلسازی را متحول میکند. این هوش مصنوعی با استفاده از…
-
🔍 کشف خطاهای هوش مصنوعی با متد GH-ESD؛ گامی به سوی مدلهای بینایی دقیقتر!
محققان در مقاله جدیدی از چارچوب نوآورانه GH-ESD رونمایی کردند که برای شناسایی سیستماتیک خطاهای مدلهای بینایی (Vision Models) طراحی شده است. مشکل کجاست؟…
-
🚀 نقشه راه جدید برای آینده هوش مصنوعی: مدلهای دنیای سهبعدی و چهاربعدی
محققان در مقالهای جامع، دنیای “مدلهای جهانی” (World Models) را از نو تعریف کردهاند! برخلاف گذشته که تمرکز بیشتر روی ویدیوهای دوبعدی بود، حالا…