دسته: arXiv Machine Learning (cs.LG)
-
🚀 جهشی جدید در درک ساختار شبکههای عصبی ReLU
محققان در یک مقاله جدید، مرزهای نظری شبکههای عصبی ReLU را جابهجا کردند! این تیم نشان داد که میتوان عملیات «بیشینه» (max) برای ۱۰…
-
🚀 معرفی ابزار جدید Molt: انقلابی در آموزش هوش مصنوعی عاملمحور!
محققان دنیای هوش مصنوعی به خوبی میدانند که تغییر الگوریتمها و کار با فریمورکهای پیچیده چقدر میتواند زمانبر و دشوار باشد. اما خبر خوب…
-
🚀 پیشرفت چشمگیر هوش مصنوعی در شبکههای مخابراتی نسل آینده (O-RAN)!
محققان مدل جدیدی به نام «Monotone FedNAM» معرفی کردند که به صورت هوشمند و دقیق، ریسکهای احتمالی در سرویسهای شبکه (SLA) را پیشبینی میکند.…
-
💡 نوآوری جدید در هوش مصنوعی: فشردهسازی و شفافیت بیشتر با NAP
محققان در مقاله جدیدی، چارچوب تازهای به نام «Neural Atom Prevalence» یا به اختصار NAP معرفی کردهاند که گامی بزرگ برای حل چالشهای «جعبه…
-
🏗️ هوش مصنوعی به کمک زیرساختهای حیاتی؛ تشخیص هوشمند آسیب پلها! 🌉
محققان در یک پژوهش جدید، از ترکیب «هوش مصنوعی» و «دانش تخصصی مهندسی» برای حل یک چالش بزرگ استفاده کردهاند. شناسایی دلایل نامرئی تخریب…
-
🚀 پیشبینی دقیقتر سریهای زمانی با معماری جدید CARNet! 📈🤖
مدلسازی وابستگیهای پیچیده در دادههای سری زمانی، همیشه یکی از چالشهای بزرگ در یادگیری ماشین بوده است. مدلهای مبتنی بر توجه (Attention) معمولاً با…
-
🔍 آیا «توجه» (Attention) در مدلهای زبانی همیشه حقیقت را میگوید؟
تحقیقات جدید arXiv نشان میدهد که تکیه صرف به الگوهای Attention در ترنسفورمرها ممکن است گمراهکننده باشد! محققان دریافتند که مدلها گاهی به حقایق…
-
🚀 استنتاج مبتنی بر شبیهسازی (SBI) با طعم یادگیری ماشین؛ ابزاری قدرتمند برای حل مسائل علمی!
دانشمندان در مقالهای جدید به سراغ بررسی عمیق روشهای SBI رفتهاند. این روشها که در حوزههای مهندسی و علوم پایه بسیار حیاتی هستند، به…
-
🚀 انقلابی در سرعت پردازش ترنسفورمرها با معماری جدید RED-PIM! 🤖⚡
مدلهای ترنسفورمر (مثل همین ChatGPT خودمان!) برای اجرا به جابهجایی عظیم دادهها بین حافظه و پردازنده نیاز دارند که باعث کندی و اتلاف انرژی…
-
🚀 نوآوری جذاب در بهینهسازی مدلهای زبانی: استفاده از فشردهسازی برای توجه (Attention) هوشمندتر!
محققان در مقاله جدیدی روشی خلاقانه ابداع کردهاند که در آن با استفاده از تکنیکهای کلاسیک فشردهسازی داده (مثل Gzip)، لایههای توجه در مدلهای…