دسته: arXiv Computer Vision (cs.CV)
-
🚀 بزرگتر همیشه بهتر نیست؛ افشاگری در دنیای مدلهای هوش مصنوعی! 🧠🔍
حتماً شنیدهاید که «مدلهای بزرگتر و دادههای بیشتر» همیشه کلید موفقیت در هوش مصنوعی هستند. اما یک تحقیق جدید روی پروژههای «دیدبانی زمین» (Earth…
-
🚀 انقلاب در ویرایش متنهای داخل تصویر؛ معرفی WeEdit! ✍️🎨
تا به حال برایتان پیش آمده که بخواهید متنی را داخل یک عکس با هوش مصنوعی تغییر دهید، اما نتیجه نهایی تار یا ناخوانا…
-
🚀 هوش مصنوعی همزمان با تماشا، «فکر» میکند! 🎥🤔
محققان در یک دستاورد هیجانانگیز، تکنیک جدیدی به نام VST (Video Streaming Thinking) معرفی کردند که به مدلهای ویدئویی (VideoLLMs) اجازه میدهد در لحظه…
-
🚀 پایان «کوری فضایی» در هوش مصنوعی؛ معرفی مدل VEGA-3D
مدلهای زبانی چندوجهی (MLLM) علیرغم هوش بالایی که دارند، معمولاً در درک ابعاد سهبعدی و فیزیک محیط دچار ضعف هستند. حالا پژوهشگران با معرفی…
-
🚀 هوش مصنوعی در دنیای واقعی؛ خداحافظی با محدودیتهای محیطی در تشخیص اشیاء! 🧠📦
محققان در پژوهشی جدید، مدل انقلابی PICA را برای بهبود «تشخیص اشیاء با واژگان باز» (OVOD) معرفی کردند. مشکل اصلی مدلهای قبلی این بود…
-
🚀 هوش مصنوعی در تست هوش ویدئویی؛ آیا مدلها واقعاً «درک» میکنند؟ 🎥🧠
محققان بهتازگی بنچمارک جدیدی به نام VidNum-1.4K معرفی کردند که توانایی مدلهای زبانی-تصویری (VLM) را در «استدلال عددی» بر اساس ویدئو به چالش میکشد.…
-
🚀 احیای آثار باستانی با جادوی هوش مصنوعی؛ معرفی مدل HMAT 🎨🏛️
بازسازی دیوارنگارههای قدیمی همیشه یکی از سختترین چالشها برای مرمتگران بوده، اما حالا هوش مصنوعی به کمک هنر آمده است! محققان فریمورک جدیدی به…
-
🚀 داوری هوشمند و دقیقِ حرکات ورزشی با هوش مصنوعی! 🏋️♂️🤖
تا به حال به این فکر کردید که چطور میتوان حرکات ورزشی را بدون خطای انسانی و با دقت بالا قضاوت کرد؟ محققان سیستم…
-
🚀 تولید تصاویر دقیقتر؛ خداحافظی با تاری و حذف جزئیات! 🎨🤖
تا به حال دقت کردید که هوش مصنوعی در حفظ جزئیات ریزِ تصاویر مثل لوگوها یا متنها چقدر مشکل دارد؟ محققان در یک پژوهش…
-
🚀 ادیت ویدیوهای طولانی با هوش مصنوعی؛ حالا با دقت و کنترل بیشتر! 🎬🤖
محققان سیستم جدیدی به نام «Crayotter» معرفی کردند که کارِ ساخت و ویرایش ویدیوهای بلند رو برای هوش مصنوعی متحول کرده! برخلاف مدلهای قبلی…