دسته: arXiv AI (cs.AI)
-
👁️ شکست مدلهای بینایی-زبانی در آزمون «مشاهده فعال»!
آیا مدلهای قدرتمند هوش مصنوعی مثل GPT-5.5 یا Claude واقعاً «میبینند»؟ یک مطالعه جدید با معرفی بنچمارک ActiveVision نشان میدهد که این مدلها در…
-
🚀 بهینهساز Muon؛ سلاح مخفی جدید برای تقویت ایجنتهای هوشمند!
محققان در یک پژوهش جدید، پتانسیل فوقالعاده «Muon» را در دنیای یادگیری تقویتی (Reinforcement Learning) بررسی کردهاند. نتایج نشان میدهد که برخلاف تصور، Muon…
-
🛡️ هوش مصنوعی در خدمت امنیت خودروهای خودران: تحلیل دقیقتر تهدیدات!
محققان در یک پژوهش جدید، پتانسیل مدلهای زبانی متنباز (Open-Weight LLMs) را برای استخراج دادههای ساختاریافته از گزارشهای امنیتی (CVE) بررسی کردهاند. هدف این…
-
🚀 یادگیری تقویتی آفلاین؛ گامی فراتر با تکنیک جدید RAD
یکی از چالشهای اصلی در یادگیری تقویتی (Offline RL)، محدود بودن مدلها به دادههای ثابت و ناتوانی در تعمیم به سناریوهای جدید است. محققان…
-
🧠 تلفیق هوش مصنوعی و منطق: گامی بزرگ در استدلال روی دادههای گراف!
محققان اخیراً چارچوب جدیدی معرفی کردهاند که شبکههای عصبی گراف (GNN) را با شبکههای بیزی رابطهای (RBN) ترکیب میکند. این رویکرد «نورو-سمبلیک» (Neuro-Symbolic) به…
-
🎮 هوش مصنوعی که مثل یک طراح حرفهای عمل میکند: معرفی VIPCGRL
آیا هوش مصنوعی میتواند پا به پای طراحان، در تولید محتوای بازیها خلاقیت نشان دهد؟ محققان بهتازگی چارچوب جدیدی به نام VIPCGRL معرفی کردهاند…
-
🚀 خداحافظی با خطاهای ساختاری؛ معرفی RL-Struct برای خروجیهای دقیق در LLMها
یکی از چالشهای بزرگ در استفاده از مدلهای زبانی بزرگ، ناتوانی آنها در تولید خروجیهای ساختاریافته (مثل JSON) با دقت بالاست. حالا محققان چارچوب…
-
🧠 رمزگشایی از تفکر در مدلهای زبانی: آیا AI واقعاً میفهمد؟
تا به حال فکر کردهاید که مدلهای هوش مصنوعی چگونه پیچیدگیهای ذهنی را پردازش میکنند؟ محققان در مطالعهای جدید با استفاده از «طبقهبندی بلوم»…
-
🖋 پارادوکس داستاننویسی: چرا هوش مصنوعی هنوز در نوشتن رمان ضعیف است؟
شاید تعجب کنید که با وجود آموزش مدلهای زبانی با میلیونها کتاب، هنوز هم خروجیهای خلاقانه و طولانیمدت آنها چندان جذاب نیست. محققان در…
-
📊 دقیقتر از همیشه؛ معرفی SciVisAgentBench برای ارزیابی تحلیلهای علمی توسط هوش مصنوعی
آیا هوش مصنوعی میتواند به یک تحلیلگر و متخصص در تجسم دادههای علمی تبدیل شود؟ محققان برای پاسخ به این سوال، بنچمارک جدیدی به…