دسته: arXiv Computer Vision (cs.CV)
-
🤖 هوش مصنوعی و درک عمیقتر تعاملات دست و اشیاء؛ معرفی پارادایم جدید در بینایی ماشین
محققان در پژوهشی جدید، راهکار هوشمندانهای برای بهبود مدلهای ویدیو-زبان پیدا کردهاند. این مدلها اغلب در درک تعاملات «دست و شیء» (HOI) دچار خطا…
-
🔍 هوش مصنوعی و چالش نادیده گرفتهشده: حذف کلیشهها درباره معلولیت
محققان در مقاله جدیدی به سراغ یکی از موضوعات مهم و کمتر بررسیشده در مدلهای تبدیل متن به تصویر (T2I) رفتهاند: «سوگیری نسبت به…
-
👁️ هوش مصنوعی و درک عمیق دنیای پیرامون با Whareformer
محققان در تازهترین دستاورد خود، مدل پیشرفتهای به نام «Whareformer» را معرفی کردهاند که انقلابی در نحوه تعامل رباتها و سیستمهای بینایی با دنیای…
-
🚀 تحولی در شناسایی اشیاء با مدل «VocaDet»
محققان در مقاله جدیدی، چارچوب نوآورانه «VocaDet» را برای شناسایی و بخشبندی اشیاء (Object Detection & Segmentation) معرفی کردهاند که نیازی به آموزش مجدد…
-
🚀 بهینهسازی هوش مصنوعی با «Switch-Reasoner»: فکر کردن یا پاسخ مستقیم؟ مسئله این است! 🧠
مدلهای زبانی چندوجهی (MLLM) معمولاً برای هر سوالی، یک مسیر فکری ثابت را طی میکنند که گاهی باعث هدررفت انرژی و زمان میشود. محققان…
-
🔍 گامی بزرگ در تفسیرپذیری مدلهای چندوجهی با S²AE
محققان در تازهترین دستاورد خود، روشی نوآورانه به نام «Structured Sparse Autoencoder» یا به اختصار S²AE معرفی کردهاند که تحولی در درک عملکرد مدلهای…
-
🔍 تشخیص تصاویر جعلی؛ سلاح جدید هوش مصنوعی در برابر دیپفیکها!
دنیای هوش مصنوعی روزبهروز واقعیتر میشود و همین موضوع باعث شده تشخیص تصاویر ساخته شده توسط AI (یا همان دیپفیکها) به یک چالش بزرگ…
-
🔍 معمای رزولوشن در تشخیص بیماریهای چشمی با هوش مصنوعی
آیا افزایش رزولوشن تصاویر پزشکی همیشه به نفع مدلهای هوش مصنوعی است؟ نتایج یک مطالعه جدید نشان میدهد که پاسخ لزوماً مثبت نیست! محققان…
-
🚀 جهش در پردازش ویدیو با مدل هوشمند SAM-MT!
محققان در یک دستاورد تازه، مدل جدید «SAM-MT» را معرفی کردهاند که دنیای بخشبندی ویدیو (Video Segmentation) را متحول میکند. این مدل که بر…
-
🔍 چالش بزرگ برای دیپفیکها: معرفی HumanForge!
با پیشرفت مدلهای تولید ویدیو، تشخیص محتوای جعلی به یک کلاف سردرگم تبدیل شده است. محققان برای مقابله با این چالش، مجموعه داده جدیدی…