دسته: مقالات علمی
جدیدترین مقالات دانشگاهی، تئوریهای یادگیری ماشین، پردازش تصویر و زبان طبیعی از مرجع معتبر arXiv.
-
🚀 ارتقای دقت مدلهای بینایی ماشین با تکنیک جدید Sparse Attention
محققان در مقاله جدیدی به سراغ رفع یکی از چالشهای اصلی مدلهای CLIP رفتهاند. مدلهای CLIP معمولاً با استفاده از لایههای Softmax معمولی، روی…
-
🛰️ انقلابی در تحلیل تصاویر ماهوارهای؛ شناسایی تغییرات زمین با مدل ASFR-Net!
محققان در مقاله جدیدی، معماری پیشرفتهای به نام ASFR-Net را معرفی کردهاند که چالش تشخیص تغییرات در تصاویر ماهوارهای ناهمگون (Heterogeneous) را حل میکند.…
-
🚀 بازسازی سهبعدی دقیقتر؛ پایان «خطای دریفت» با مدل NoDrift3R!
یکی از چالشهای اصلی در بازسازی سهبعدی صحنهها بدون داشتن اطلاعات دوربین (Unposed)، جمع شدن خطاها در طول زمان است که باعث کاهش کیفیت…
-
🔬 تحولی در شناسایی دقیق مواد دوبعدی با هوش مصنوعی!
محققان در مقاله جدیدی، فریمورک نوآورانهای به نام TACoS را معرفی کردهاند که کار segmentation یا قطعهبندی دقیق تصاویر مواد دوبعدی (مثل گرافن) را…
-
🚀 جهشی جدید در درک سهبعدی محیط با هوش مصنوعی!
محققان در مقاله جدیدی، فریمورک نوآورانه «PUF» را معرفی کردهاند که دنیای گرافهای صحنه سهبعدی (3D Scene Graph) را متحول میکند. مشکل اصلی روشهای…
-
🎨 انقلابی در شخصیسازی تولید تصویر با هوش مصنوعی! 🚀
محققان در مقاله جدیدی، چارچوب نوآورانه «SPaRa-DCAL» را معرفی کردهاند که دنیای تولید تصویر با متن (Text-to-Image) را یک قدم به جلو برده است.…
-
📊 هوش مصنوعی و چالش درک اسناد؛ کدام مدلها در تحلیل مدارک بهتر عمل میکنند؟
محققان در پژوهشی تازه، ۸ مدل پیشرفته بینایی-زبانی (VLM) را برای پاسخگویی به سوالات متنی-تصویری (DocVQA) در حوزههای مختلف مثل اسناد صنعتی، اینفوگرافیکها و…
-
🎨 تحول در ویرایش سهبعدی با هوش مصنوعی! معرفی EditVerse3D
ویرایش اشیاء سهبعدی همیشه چالشبرانگیز بوده، اما مدل جدید EditVerse3D این بازی را عوض کرده است! 🚀 این فریمورک هوشمند به شما اجازه میدهد…
-
🚀 گامی رو به جلو در تشخیص اشیاء؛ غلبه بر چالشهای دنیای ناشناخته!
محققان در مقاله جدیدی، مدل نوآورانه MR-DCoT را معرفی کردهاند که مشکل تشخیص اشیاء در دامنههای ناشناخته (Unknown-Domain) را حل میکند. برخلاف روشهای قدیمی…
-
🎥 خداحافظی با تاری ویدیوها به کمک هوش مصنوعی!
محققان مدل جدیدی به نام DiffCVE معرفی کردهاند که با استفاده از مدلهای انتشار (Diffusion Models)، کیفیت ویدیوهای بهشدت فشرده و بیکیفیت را بهطرز…