دسته: مقالات علمی
جدیدترین مقالات دانشگاهی، تئوریهای یادگیری ماشین، پردازش تصویر و زبان طبیعی از مرجع معتبر arXiv.
-
🚀 بهینهسازی ادغام مدلهای هوش مصنوعی با روش جدید DTE
محققان به راهکار جذابی برای ترکیب مدلهای تخصصی (Experts) دست یافتهاند! در روشهای فعلی، ترکیب مدلهای مختلف اغلب با چالش تداخل وزنها مواجه است.…
-
🚀 نقشه برداری دقیقتر با هوش مصنوعی: معرفی سیستم NSL-SLAM
محققان در دستاوردی جدید، سیستم «NSL-SLAM» را معرفی کردهاند که با ترکیب فناوری «نور ساختاریافته» (Structured-Light) و پیشرانهای عمقسنجی هوشمند، دقت بازسازی سهبعدی و…
-
📊 انقلابی در آموزش مدلهای بینایی-زبانی (VLM) با متد DecoupleMix!
محققان در مقالهای جدید، رویکردی هوشمندانه به نام «DecoupleMix» را برای بهینهسازی دادههای آموزشی معرفی کردهاند. این روش به جای تکیه بر حدس و…
-
🎬 تحول در ویرایش هوشمند ویدیوهای اولشخص با EgoPlay
آیا تا به حال به این فکر کردهاید که هوش مصنوعی بتواند فقط در لحظات خاصی از یک ویدیو (مثلاً وقتی چیزی میخورید یا…
-
🎥 عبور از گلوگاه پردازش ویدیوها با مدلهای هوش مصنوعی!
حتماً میدانید که تحلیل ویدیوهای طولانی توسط مدلهای زبانی چندوجهی (MLLM) به دلیل محدودیت پردازش فریمها، همیشه یک چالش بزرگ بوده است. محققان به…
-
🧠 هوشمندتر کردن درک ویدیوهای طولانی با CADER!
دانشمندان یک چارچوب جدید به نام CADER (مخفف Confidence-Aware Dynamic Evidence Reasoning) معرفی کردند که به مدلهای بینایی-زبانی کمک میکند تا ویدیوهای طولانی را…
-
🎥 کنترل کامل روی دوربین؛ معرفی مدل هوشمند CameraAnything! 🎬
محققان در یک دستاورد جدید، چارچوبی به نام «CameraAnything» را معرفی کردهاند که دنیای ادیت ویدیو را متحول میکند. این مدل اجازه میدهد بدون…
-
🚀 تحولی در تشخیص و ردیابی اشیاء در ویدیوها: معرفی مدل QueenVIS
محققان در یک دستاورد جدید، مدل «QueenVIS» را برای بهبود «بخشبندی نمونههای ویدیویی» (VIS) معرفی کردهاند. این مدل با رفع چالش «کیفیت کوئریهای شیء»،…
-
🚀 هوش مصنوعی در برابر چالشهای دنیای واقعی: معرفی فریمورک TADD
مدلهای یادگیری عمیق در محیطهای آزمایشگاهی عالی عمل میکنند، اما وقتی با شرایط واقعی و تغییر توزیع دادهها (Distribution Shift) روبرو میشوند، کاراییشان افت…
-
🔍 پایانِ «توهماتِ ارجاعی» در مدلهای بینایی-زبانی! 📄
محققان در یک پژوهش جدید، راهکار هوشمندانهای برای درک دقیقتر اسناد بصری (Visual Document Understanding) ارائه کردهاند. مشکل اصلی مدلهای فعلی این بود که…