دسته: arXiv Machine Learning (cs.LG)
-
🧠 رابطه پنهان میان فشردگی مدل و تصادفی بودن؛ کشف جدید در دنیای Deep Learning!
محققان در مقاله جدید خود به سراغ مفاهیم بنیادیتری رفتهاند: «فرضیه فشردگی-تصادفی گیبس». این پژوهش نشان میدهد که چطور میتوان از طریق «آنتروپی گیبس»،…
-
📊 معرفی DataPrep-Bench: بنچمارکی برای سنجش کیفیت دادههای آموزشی در مدلهای زبانی
آیا تا به حال فکر کردهاید که کیفیت نهایی یک مدل هوش مصنوعی تا چه حد به «دادههای آموزشی» آن وابسته است؟ محققان بهتازگی…
-
🚀 جهشی نو در بازیابی اطلاعات: معرفی معماری Multimodal CoLRAG-TF
محققان در مقالهای جدید، راهکاری پیشرفته برای حل یکی از چالشهای بزرگ سیستمهای RAG (بازیابی-تولید تقویتشده) یعنی کار با اسناد پیچیده و چندرسانهای (PDF)…
-
🧠 پیشرفت در بهینهسازی مدلهای ترنسفورمر: هوشمندتر و کمهزینهتر!
محققان در مقاله جدیدی به بررسی ساختار «ترنسفورمرهای حلقوی» (Looped Transformers) پرداختهاند تا چالشهای مربوط به «عمق تطبیقی» در آنها را حل کنند. تکنولوژی…
-
🚀 تحولی در تخمین وضعیت سیستمهای پویا با فیلترینگ بیزی مولد (GBF)
محققان در مقالهای جدید، روشی نوآورانه به نام «GBF» معرفی کردهاند که دنیای فیلترینگ کلاسیک (مانند فیلتر کالمن) را با قدرت مدلهای مولد (CVAE)…
-
🔍 معمایی در دلِ مدلهای زبانی: آیا ویژگیهای فعال «هولونومی» کمتری دارند؟ 🧐
محققان در مطالعهای جدید و پیشثبتشده (Preregistered)، به سراغ مدل «Gemma 2 2B» رفتهاند تا رابطهی بین ویژگیهای فعال در «رمزگذارهای خودکار پراکنده» (SAE)…
-
🚀 مدیریت هوشمند ترافیک هوایی با یادگیری تقویتی!
محققان در یک پژوهش جدید، از مدلهای «یادگیری تقویتی چندعامله» (Multi-Agent RL) برای مدیریت پروازهای بدونسرنشین (UAV) و تاکسیهای هوایی (eVTOL) در مسیرهای هوایی…
-
🚀 تولید سناریوهای تصادف برای تست ایمنی خودروهای خودران با هوش مصنوعی
محققان در مقاله جدیدی مدل جذابی به نام «SevDiff» معرفی کردهاند که میتواند مسیر حرکت خودروها در شرایط بحرانی را با دقت بالا شبیهسازی…
-
🚀 کشف رمز «Grokking»: راهکاری جدید برای تعمیم بهتر در شبکههای عصبی
آیا تا به حال شنیدهاید که مدلهای هوش مصنوعی مدتها پس از حفظ کردن دادههای آموزشی، تازه شروع به یادگیری و «تعمیم» (Generalization) میکنند؟…
-
🚀 کشف «بلیطهای بختآزمایی» در شبکههای عصبی!
محققان در مقاله جدیدی سراغ یکی از مفاهیم جذاب دنیای یادگیری عمیق، یعنی «فرضیه بلیط بختآزمایی» (Lottery Ticket Hypothesis) رفتهاند. این فرضیه میگوید شبکههای…