برگزیده ها مشاهده همه ›
Hacker News LLM مشاهده همه ›
شرکتهای هوش مصنوعی مشاهده همه ›
مقالات علمی مشاهده همه ›
-
🚀 جهش بزرگ در سرعت آموزش هوش مصنوعی با DualKV!
محققان در مقالهای جدید، تکنیک نوآورانهای به نام «DualKV» را معرفی کردهاند که به طور چشمگیری سرعت آموزش مدلهای زبانی (RL Training) را افزایش…
-
🚀 هوش مصنوعی در خدمت پایداری شتابدهندههای ذرات!
دانشمندان به تازگی برای کاهش خرابیهای ناگهانی در منبع نوترون اسپالیشن (SNS)، یک مدل یادگیری عمیق سبکوزن مبتنی بر CNN طراحی کردهاند. این مدل…
-
🚀 بهینهسازی حرفهای در سمپلینگ: وقتی هوش مصنوعی تصمیم میگیرد چه زمانی متوقف شود! 🧠
در دنیای محاسبات احتمالی و روشهای MCMC، یکی از چالشهای همیشگی تعیین طول مسیر حرکت (Trajectory) بوده است. حالا محققان با استفاده از شبکه…
-
🚀 تحولی در مدلسازی فیزیکی با هوش مصنوعی: معرفی FaNO
محققان به تازگی معماری جدیدی به نام «عملگرهای عصبی فاکتوریزه» (Factorized Neural Operators) یا همان FaNO معرفی کردهاند که گامی بزرگ برای شبیهسازی دقیقتر…
-
🚀 تحولی در آموزش شبکههای عصبی: تفکیک وزنها برای یادگیری بهینهتر!
محققان روش جدیدی به نام «Magnitude-Direction (MD) Decoupling» معرفی کردهاند که دنیای آموزش مدلهای هوش مصنوعی را تغییر میدهد. این متد جدید با جدا…
-
🧠 پیشرفت در یادگیری طولانیمدت شبکههای عصبی
محققان در مطالعهای جدید، چالش همیشگی «فراموشی» در شبکههای عصبی بازگشتی (RNN) را بررسی کردند. مشکل اصلی اینجاست که شبکهها در یادگیری وابستگیهای طولانیمدت…
-
🚀 هوش مصنوعی در خدمت لجستیک و برنامهریزی هوشمند!
محققان در مقاله جدیدی نشان دادند که چگونه میتوان از مدلهای زبانی بزرگ (LLM) برای بهینهسازی ظرفیت مراکز حملونقل استفاده کرد. این مدل با…
-
🚀 پیشرفت جدید در استنتاج علّی با دادههای مصنوعی ایمن! 🛡️
محققان در پژوهش جدید خود روشی نوآورانه برای تولید «دادههای مصنوعی» (Synthetic Data) معرفی کردهاند که ضمن حفظ حریم خصوصی (Differential Privacy)، دقت استنتاجهای…
-
🚀 جهشی نو در مدلهای استدلال بازگشتی: معرفی مدل Energy-guided Recursive (ERM)
مدلهای بازگشتی (Recursive Models) برای حل مسائل ساختاریافته عالی هستند، اما تا به حال در انتخاب مسیر درست هنگام افزایش عمق یا تعداد شاخهها…
-
🚀 جهش در کارایی مدلهای زبانی: فشردهسازی هوشمند KV Cache با روش JoLT!
محققان در مقالهای جدید، راهکار نوآورانهای به نام JoLT برای فشردهسازی حافظه KV Cache در مدلهای ترنسفورمر (LLM) معرفی کردهاند. همانطور که میدانید، حجم…









