دسته: arXiv Machine Learning (cs.LG)
-
🧠 کنترل دقیقتر مدلهای زبانی؛ راز «قدرت هدایت» در LLMها کشف شد!
تا به حال فکر کردید وقتی مدلهای زبانی را برای انجام کارهای خاص «هدایت» (Steering) میکنیم، چقدر باید به آنها فشار بیاوریم؟ اگر خیلی…
-
🧠 پیشبینی دقیقتر اعداد با مدلهای هوش مصنوعی
محققان در پژوهشی جدید به سراغ حل یکی از چالشهای جذاب در مدلسازی رفتند: چطور میتوان خروجیهای عددی (مثل تعداد لایکها یا موجودی انبار)…
-
🔍 آیا ترکیب کردن LoRAها واقعاً موثر است؟
محققان در یک پژوهش جدید و بسیار جذاب به سراغ بررسی «ترکیب یا Merge کردن LoRAها» رفتهاند؛ تکنیکی که این روزها در دنیای مدلهای…
-
🧠 دستیابی به تضمینهای دقیقتر در یادگیری عمیق با رویکرد جدید!
یکی از چالشهای بزرگ در مدلهای یادگیری عمیق، «حدود تعمیمدهی» (Generalization Bounds) است که اغلب در عمل بسیار مبهم یا غیرقابل محاسبه هستند. اما…
-
🔍 پردهبرداری از رازهای درونی مدلهای زبانی: معرفی متد DPA
تا حالا فکر کردید مدلهای غولپیکر زبانی (LLMs) چطور تصمیم میگیرند؟ فهمیدن سازوکار درونی ترنسفورمرها همیشه چالشبرانگیز و هزینهبر بوده، اما حالا متد جدیدی…
-
🧠 الهام از مغز مگس سرکه برای هوش مصنوعی؛ معرفی روش SyCo!
مدلهای زبانی (LLMs) معمولاً وقتی با دادههای جدید یا محیطهای در حال تغییر مواجه میشوند، دچار «فراموشی» یا افت کیفیت میشوند. حالا محققان با…
-
🚀 گامی بزرگ در هوش مصنوعی برای رباتهای خودمختار: معرفی فریمورک ERA!
محققان در مقاله جدیدی، چارچوب نوآورانه «ERA» (مخفف Event-Retrieve-Action) را برای بهبود تصمیمگیری رباتها در محیطهای پویا معرفی کردهاند. این مدل بهجای تکیه بر…
-
🚀 پردازش سریعتر متون طولانی با مدل جدید Nectar
محققان تکنیک نوآورانهای به نام «Nectar» را معرفی کردهاند که میتواند انقلابی در نحوه پردازش متنهای طولانی (مثل کتابها یا اسناد حقوقی) توسط مدلهای…
-
🚀 هماهنگی دقیقتر در سیستمهای چندعاملی با مدل TeamTR
تا به حال دقت کردید که وقتی چند هوش مصنوعی قرار است با هم همکاری کنند، گاهی عملکردشان از یک مدل تکی هم ضعیفتر…
-
🚀 عبور از گلوگاه سرعت در مدلهای زبانی: معرفی معماری SNLP!
محققان در مقالهای جدید، روش نوآورانه «SNLP» (مخفف Structured Newton Layer Parallelism) را برای افزایش سرعت استنتاج در مدلهای زبانی ترنسفورمر معرفی کردهاند. مشکل…