دسته: arXiv Computer Vision (cs.CV)
-
🚀 جهش در کیفیت تولید تصویر با تکنیک جدید LGQ!
محققان به تازگی روش نوآورانهای به نام «کوانتیزاسیون هندسی یادگیرنده» (Learnable Geometric Quantization) یا همان LGQ معرفی کردهاند که تحولی در توکنسازی تصاویر ایجاد…
-
🩺 تحول در تشخیص پزشکی با فریمورک هوشمند PRIMA! 🧠
محققان در تازهترین پژوهش خود، چارچوب نوآورانهای به نام «PRIMA» را معرفی کردند که دنیای تشخیصهای پزشکی را دگرگون میکند. این فریمورک با ترکیب…
-
🚀 تشخیص دقیقتر اهداف در تصاویر راداری با مدل هوشمند RSTNet
محققان مدل جدیدی به نام RSTNet را معرفی کردهاند که بر پایه معماری YOLOv8 ساخته شده و هدف آن، شناسایی دقیقتر شناورهای کوچک در…
-
🔍 راز «تعمیمپذیری» در مدلهای بینایی؛ چرا هوش مصنوعی باید مثل انسان ببیند؟
محققان در مطالعهای جدید به بررسی این سوال پرداختهاند که هوش مصنوعی برای درک مفاهیم در شرایط جدید (که قبلاً ندیده) به چه ساختار…
-
🛡️ تشخیص تصاویر پزشکیِ جعلی: هوش مصنوعی علیه تهدیدات امنیتی!
با پیشرفت مدلهای تولید تصویر، تصاویر جعلی سیتیاسکن (CT) هم به یکی از چالشهای جدید در امنیت دادههای پزشکی تبدیل شدهاند. محققان برای مقابله…
-
🚀 آیندهای که در آن هوش مصنوعی دنیای سه بعدی را بهتر درک میکند: معرفی Utonia
تا به حال به این فکر کردهاید که اگر هوش مصنوعی بتواند تمامی دادههای سهبعدی را با یک مدل واحد درک کند، چه اتفاقی…
-
🚀 آینده هوش مصنوعی چندوجهی: ظهور مدل Omni-Diffusion
محققان در دستاوردی جدید، مدل انقلابی «Omni-Diffusion» را معرفی کردند که دنیای مدلهای زبانی را تکان داده است! برخلاف مدلهای فعلی که بیشتر بر…
-
🧠 هوش مصنوعی و رمزگشایی از ظریفترین احساسات انسانی
محققان در تازهترین دستاورد خود، مدل جدیدی به نام AULLM++ را معرفی کردهاند که در شناسایی «ریز-حالات چهره» (Micro-expressions) تحول ایجاد کرده است. 🧐…
-
🚀 بهینهسازی انقلابی در تولید ویدیو با هوش مصنوعی: معرفی SVG-EAR
مدلهای ترنسفورمر (DiTs) که ستون فقرات تولید ویدیوهای خیرهکننده با هوش مصنوعی هستند، همیشه با چالش هزینه محاسباتی بالای «توجه» (Attention) روبرو بودهاند. حالا…
-
🧬 انقلابی در تصویربرداری پزشکی با هوش مصنوعی؛ معرفی VesselTok
محققان در یک پژوهش جدید، مدل نوآورانه «VesselTok» را معرفی کردند که دنیای آناتومی بدن را دگرگون میکند! 🩺 این فریمورک با استفاده از…