دسته: arXiv Machine Learning (cs.LG)
-
📐 نگاهی متفاوت به قلب ترنسفورمرها؛ هندسه در خدمت هوش مصنوعی! 🤖
محققان در یک دستاورد علمی جدید، چارچوب ریاضی تازهای را برای درک عملکرد مدلهای زبانی بزرگ (Transformer) معرفی کردهاند. این پژوهش، عملیات پیچیده مدلهایی…
-
🚀 بهینهسازی مدلهای عظیم در لبه شبکه با OrderMoE!
اجرای مدلهای Mixture-of-Experts (MoE) روی دستگاههای لبه که منابع محدودی دارند، همیشه یک چالش بزرگ بوده. اما محققان به تازگی چارچوب جدیدی به نام…
-
🚀 گامی تازه در دنیای یادگیری تقویتشده (Reinforcement Learning)!
محققان در مقاله جدیدی به بررسی چالش «شناسایی بهترین سیاست» (BPI) در یادگیری تقویتشده پرداختهاند. تا پیش از این، اکثر روشها مثل الگوریتم معروف…
-
📊 بازتعریف محدودیتهای فشردهسازی در عصر هوش مصنوعی
آیا میدانستید مفهوم کلاسیک «نرخ-اعوجاج» (Rate-Distortion) در حال بازنویسی است؟ محققان در مطالعهای جدید، تئوری «نرخ-اعوجاج-ادراک» (RDP) را معرفی کردهاند که فراتر از اندازهگیریهای…
-
🚀 رمزگشایی از مدلهای یادگیری کوانتومی! ⚛️
محققان در یک پیشرفت جدید، چارچوب احتمالی تازهای برای درک بهتر نحوه عملکرد مدلهای «یادگیری ماشین کوانتومی» (Quantum Machine Learning) ارائه کردهاند. این تحقیق…
-
🚀 پیشرفت در الگوریتمهای پیشبینی توالی؛ نگاهی به “اتوماتیک بودن از راست به چپ” 🤖
محققان در مقاله جدیدی به سراغ بهبود الگوریتمهای پیشبینی توالی رفتهاند. این تحقیق بر روی دو مفهوم پیچیده یعنی «اتوماتیک بودن از راست به…
-
🚀 جهش در پردازش گرافهای غولآسا: معرفی Taurus!
محققان در یک مقاله جدید، سیستم نوآورانه «Taurus» را معرفی کردهاند که تحولی در اجرای شبکههای عصبی گراف (GNN) ایجاد میکند. این سیستم به…
-
🔍 تشخیص دقیقتر متون هوش مصنوعی؛ دستاورد جدید تیم DACTYL!
محققان در رقابت PAN 2026 با استفاده از مدلهای پیشرفتهای مثل ModernBERT، روشی نوآورانه برای شناسایی بهتر متون تولید شده توسط AI ارائه دادند.…
-
🚀 نوآوری در تحلیل دادههای پیچیده: معرفی متد KReTTaH
محققان در مقاله جدیدی از چارچوب نوین KReTTaH رونمایی کردهاند که یک روش غیرپارامتریک و تفسیرپذیر برای بازسازی دادههای مفقود (Imputation) است. 🔹 این…
-
🚀 بهینهسازی هوشمند ارزیابی مدلهای زبانی بزرگ (LLM) 📊
محققان در مقاله جدید خود به سراغ چالش ارزیابی کارآمد مدلهای زبانی بزرگ رفتهاند. این تحقیق با استفاده از دادههای عملکرد مدلهای قبلی و…