دسته: arXiv Computer Vision (cs.CV)
-
👁️ بهینهسازی بینایی ماشین با تکنیک جدید VisionScreen
محققان در تازهترین دستاورد خود، مدل جدیدی به نام VisionScreen را معرفی کردهاند که میتواند جایگزین بهینهتری برای Vision Transformer (ViT)های سنتی باشد. مدلهای…
-
🧠 تکنیک جدید برای درک دقیقتر احساسات انسانی با هوش مصنوعی
محققان در تازهترین دستاورد خود، روش نوینی برای تحلیل رفتارهای عاطفی (Affective Behavior Analysis) معرفی کردهاند. این مدل با استفاده از رویکرد «تلفیق ویژگیهای…
-
🚗 شبیهسازی واقعگرایانه دنیای رانندگی با هوش مصنوعی M4World
محققان در یک پیشرفت هیجانانگیز، مدل جدیدی به نام M4World را معرفی کردهاند که دنیای رانندگی را با دقت بیسابقهای بازسازی میکند. این مدل…
-
🎮 آیا هوش مصنوعی جای موتورهای بازیسازی را میگیرد؟
محققان به تازگی در مقالهای جذاب به بررسی چگونگی تبدیل مدلهای مولد ویدئو به «موتورهای بازی» (Game Engines) پرداختهاند. هدف این است که هوش…
-
🎬 تحول در تولید ویدئو با VideoRAE: سریعتر و دقیقتر از همیشه!
محققان در تازهترین دستاورد خود، مدل VideoRAE را معرفی کردهاند که انقلابی در نحوه کارکرد مدلهای مولد ویدئو ایجاد میکند. تا پیش از این،…
-
🤟 تولید ویدیوهای زبان اشاره با هوش مصنوعی؛ پروژهای با بودجه اقتصادی!
تولید ویدیوهای زبان اشاره همیشه به دلیل نیاز به مدلهای بزرگ و هزینههای پردازشی بالا، چالشی جدی بوده است. اما محققان در مدل جدیدی…
-
🏥 بهینهسازی هوشمند تصویربرداری پزشکی با محاسبات پیشرفته
محققان در مقالهای تازه، راهکارهای نوینی را برای رفع یکی از بزرگترین چالشهای دنیای پزشکی بررسی کردهاند: سرعت بازسازی تصاویر پزشکی. امروزه سیستمهایی مثل…
-
🤖 تکامل مغز رباتها با متد جدید Anchor-Align
محققان در دستاوردی تازه، راهکار هوشمندانهای برای بهبود عملکرد مدلهای بینایی-زبانی-کنشی (VLA) ارائه دادهاند. چالش بزرگ در رباتیک این است که هنگام آموزش مدلهای…
-
🤖 گامی بزرگ در تعادل رباتهای انساننما: معرفی EgoHTR
محققان برای حل مشکل حرکت رباتهای انساننما در محیطهای ناهموار، مجموعه داده جدیدی به نام EgoHTR را منتشر کردهاند. این پروژه با استفاده از…
-
🤖 فراتر از بینایی؛ افزایش هوش حسی رباتها با مدل Kepler-Encoder
محققان مدل جدیدی به نام Kepler-Encoder-v0.1 معرفی کردهاند که دنیای رباتیک را یک قدم به واقعیت نزدیکتر میکند. این مدل با ترکیب دادههای بصری،…