دسته: arXiv Computer Vision (cs.CV)
-
🛡️ هوش مصنوعی ایمنتر؛ مقابله با محتوای غیراخلاقی در تصاویر!
یکی از چالشهای بزرگ مدلهای تبدیل متن به تصویر (Text-to-Image)، دور زدن فیلترهای امنیتی توسط کاربران با استفاده از کلمات مبهم یا ترفندهای پیچیده…
-
👁️ شمارش دقیقتر اشیاء با مدل هوشمند UpCount! 📊
محققان در مقاله جدیدی، مدل «UpCount» را معرفی کردهاند که یک رویکرد پیشرفته برای شمارش اشیاء (Object Counting) بدون نیاز به دانستن نوع کلاس…
-
🎨 هوش مصنوعی در مسیر تولید تصویر حرفهایتر؛ معرفی روش RegToken! 🖼✨
محققان در یک دستاورد تازه، متوجه شدند که چگونه میتوان از «ثبتکنندهها» (Registers) در مدلهای بینایی ماشین (Vision Transformers) برای بهبود تولید تصویر استفاده…
-
📸 تولید صحنههای سهبعدی با دقت خیرهکننده: معرفی Scene-SAM3D
محققان دنیای هوش مصنوعی بهتازگی فریمورک جذابی به نام «Scene-SAM3D» را معرفی کردهاند که تحولی در ساخت داراییهای سهبعدی (3D Assets) ایجاد میکند. این…
-
🏥 هوش مصنوعی در اتاق عمل؛ راهکاری جدید برای تشخیص دقیق فازهای جراحی
محققان در مطالعه جدیدی، مدل «HTT-Net» را معرفی کردهاند که تحولی در درک ویدئوهای جراحی ایجاد میکند. این مدل با بهرهگیری از دانش متنی…
-
🚚 هوش مصنوعی و انقلابی در دنیای رانندگی خودران! 🤖
محققان به تازگی روش جدیدی برای تخمین «زاویه مفصل» در کامیونهای تریلر-دار معرفی کردهاند که میتواند دقت سیستمهای رانندگی خودران (Autonomous Driving) و سیستمهای…
-
📱 هوش مصنوعی در خدمت دسترسپذیری: معرفی VisionAssist
خبر خوب برای جامعه افراد کمبینا! محققان به تازگی اپلیکیشن متنباز «VisionAssist» را معرفی کردهاند که با استفاده از هوش مصنوعی، دنیای اطراف را…
-
🎥 ارزیابی دقیقتر ویدیوهای هوش مصنوعی با HVEval+ و MoE-Rater
تولید ویدیو با هوش مصنوعی هر روز واقعیتر میشود، اما چالشهای کیفیت و هماهنگی هنوز باقی است! محققان به تازگی مجموعه داده عظیم «HVEval+»…
-
🏥 انقلابی در هوش مصنوعی پزشکی: مدلهایی که بدون آموزش مجدد، متخصص میشوند!
محققان حوزه هوش مصنوعی روش جدیدی به نام «MoBE» معرفی کردند که یک چالش بزرگ در مدلهای بینایی-زبانی پزشکی (MVLMs) را حل میکند. تا…
-
🚀 انقلابی در برچسبگذاری تصاویر ماهوارهای با هوش مصنوعی! 🛰️
یکی از سختترین و پرهزینهترین بخشهای پروژههای سنجش از دور (Remote Sensing)، برچسبگذاری دستی دادهها برای آموزش مدلهای تشخیص اشیاء است. حالا یک مقاله…