دسته: arXiv NLP (cs.CL)
-
🧠 آیا هوش مصنوعی در «اطلاعات عمومی» ضعیف است؟
محققان در یک پژوهش جدید، عملکرد ۳۰ مدل زبانی بزرگ (LLM) را با بنچمارک جدید «TriviaRoomQA» به چالش کشیدهاند. نتایج جالبی به دست آمده:…
-
🌍 گامی بزرگ برای هوش مصنوعی در آفریقا: معرفی مدلهای DONDO
توسعه هوش مصنوعی نباید محدود به زبانهای پرگویش دنیا باشد. محققان بهتازگی خانوادهای از مدلهای متنباز و قدرتمند به نام «DONDO» را برای تشخیص…
-
🎮 انقلابی در آموزش پزشکی با «MedGame»: وقتی هوش مصنوعی داستانسرا میشود!
محققان بهتازگی فریمورک جذابی به نام MedGame معرفی کردهاند که یادگیری پزشکی را از حالت کتابی و خستهکننده خارج میکند. این سیستم با استفاده…
-
🤖 نقد جدی به نظریه «غافلگیری» در مدلهای زبانی
آیا واقعاً میتوان مدلهای زبانی هوش مصنوعی را معیار سنجش دشواری پردازش متن در انسان دانست؟ یک مقاله جدید و جالب در arXiv به…
-
🚀 کدنویسی امنتر با هوش مصنوعی؛ ترکیب ترنسفورمرها و LLMها
تازه چه خبر؟ محققان در پژوهش جدیدی به سراغ حل یکی از چالشهای بزرگ برنامهنویسی یعنی «خلاصهسازی کدهای منبع» رفتهاند. 💻 نکته جالب اینجاست:…
-
🧠 زنجیره تفکر (CoT) در هوش مصنوعی: ابزار حل مسئله یا منبع توهم؟
محققان در یک پژوهش جدید، عملکرد مدلهای زبانی در حوزه «شیمی» را زیر ذرهبین بردهاند. نتیجه جالب و تأملبرانگیز است: مدلهای هوش مصنوعی هنگام…
-
🚀 سرعت خیرهکننده در تشخیص گفتار: معرفی VibeVoice-ASR-BitNet
اگر با چالشهای اجرای مدلهای سنگین هوش مصنوعی روی سیستمهای معمولی یا سختافزارهای لبه (Edge) درگیر هستید، این خبر برای شماست! محققان مدل جدید…
-
🧠 حافظه هوشمند برای مدلهای زبانی: معرفی AgeMem
یکی از چالشهای اصلی ایجنتهای هوش مصنوعی (AI Agents)، محدودیت حافظه در کارهای طولانیمدت است. معمولاً حافظه کوتاهمدت و بلندمدت بهصورت جداگانه مدیریت میشوند…
-
📊 تحلیلی متفاوت بر ساختار کلمات در مدلهای زبانی: فراتر از قانون زیف!
آیا توزیع کلمات در زبان همیشه طبق «قانون زیف» پیش میرود؟ محققان در مقاله جدید خود به سراغ تحلیل توزیع کلمات توقف (Stopwords) و…
-
🚀 معرفی مدل DatedGPT؛ راهکاری هوشمندانه برای جلوگیری از «سوگیری آیندهنگر» در هوش مصنوعی
آیا تا به حال به این فکر کردهاید که اگر مدلهای زبانی از اتفاقات آینده باخبر باشند، چطور میتوانند در تحلیلهای اقتصادی و پیشبینیهای…