دسته: arXiv AI (cs.AI)
-
🧠 پیوند دنیای مدلهای JEPA و تئوری «استنتاج فعال» (Active Inference)
محققان در مقالهای تازه، پل نظری عمیقی بین معماریهای پیشبینیگر مدلهای جهان (JEPA) و تئوری «استنتاج فعال» برقرار کردهاند. این پژوهش نشان میدهد که…
-
🤖 وقتی رباتها با زبان آدمیزاد همسفر میشوند!
تصور کنید به ربات خانگیتان بگویید «برو به سمت جعبه نامه» و او بدون نیاز به برنامهنویسی پیچیده، مسیرش را پیدا کند. محققان به…
-
📄 تحولی در استخراج متن از اسناد؛ معرفی مدل قدرتمند OvisOCR2
اگر با چالشهای استخراج متن از تصاویر اسناد، جداول و فرمولهای پیچیده سر و کار دارید، حتما نگاهی به «OvisOCR2» بیندازید! این مدل جدید…
-
🚀 بهبود چشمگیر دقت مدلهای زبانی با متد جدید CANON
محققان در مقالهای جدید روش نوآورانهای به نام CANON (Consensus-ANchored self-distillatiON) را معرفی کردند که دقت مدلهای زبانی را در مسائل پیچیده ریاضی و…
-
📸 انقلاب در بازسازی سهبعدی بدن انسان با مجموعه داده عظیم Human4K
اگر در حوزه بینایی ماشین و بازسازی سه بعدی فعالیت میکنید، خبر خوبی برایتان داریم! محققان بهتازگی مجموعه داده عظیمی به نام Human4K را…
-
🎨 آیا هوش مصنوعی رنگها را مثل ما میبیند؟
محققان در مقالهای جدید به سراغ بررسی درک «رنگ» در مدلهای بینایی ماشین (Vision Models) رفتهاند. برخلاف روشهای سنتی که فقط بر هندسه رنگها…
-
✍️ دقت خیرهکننده در تشخیص دستخط با مدل سبک Barnamala!
اگر در دنیای یادگیری ماشین فعالیت میکنید، احتمالاً میدانید که کوچکسازی مدلها بدون افت دقت چقدر چالشبرانگیز است. محققان اخیراً مدل جدیدی به نام…
-
🤖 از شبیهسازهای کلاسیک تا دوقلوهای دیجیتال اجتماعی
آیا تا به حال به این فکر کردهاید که هوش مصنوعی چگونه پیچیدگیهای جامعه را شبیهسازی میکند؟ کتاب جدیدی منتشر شده که مسیر تحول…
-
🧠 پایان توهمات بینایی در مدلهای چندوجهی با متد جدید Groc-PO
مدلهای زبانی چندوجهی (MLLM) با وجود پیشرفتهای چشمگیر، هنوز درگیر مشکلاتی مثل «توهمات بصری» و خطاهای منطقی هستند. محققان برای حل این مشکل، تکنیک…
-
🛡️ امنیت هوش مصنوعی؛ چه کسی به «عاملهای هوشمند» اجازه دسترسی میدهد؟
با ورود هوش مصنوعی به کارهای حساسی مثل تراکنشهای بانکی، موضوع «اجازهدهی» و امنیت کاربران به یکی از داغترین مباحث تبدیل شده است! 🤖💸…