دسته: arXiv AI (cs.AI)
-
🚀 بهبود دقت هوش مصنوعی در تشخیص اقلیتها: معرفی روش MiPO
محققان در پژوهشی جدید روشی نوآورانه به نام MiPO را برای مدلهای طبقهبندی مبتنی بر انتشار (Diffusion Classifiers) معرفی کردهاند. این مدل با هدف…
-
🚀 معرفی SkillFab: انقلابی در مدیریت و توسعه مهارتهای ایجنتهای هوش مصنوعی
اگر در دنیای ایجنتهای هوش مصنوعی فعالیت میکنید، حتما با چالش «کمبود مهارتهای اختصاصی» برخورد کردهاید. پلتفرم جدید SkillFab با رویکردی نوآورانه (Agent-Native) این…
-
🚀 بهینهسازی خیرهکننده مدلهای هوش مصنوعی با روش جدید HetDPT
آیا تا به حال به این فکر کردهاید که چطور میتوان مدلهای سنگین بینایی ماشین (Vision Transformers) را بدون کاهش دقت، سریعتر کرد؟ محققان…
-
🚀 تحول در یادگیری هندسی: معرفی شبکه عصبی OENN برای درک عمیقتر تقارنها
محققان در مقالهای جدید، دنیای «یادگیری عمیق هندسی» (Geometric Deep Learning) را با معرفی OENN (Order-Equivariant Neural Networks) وارد فاز جدیدی کردهاند. این شبکه…
-
🚀 غولکشی با مدلهای کوچک! عملکرد شگفتانگیز TLMها در تحلیلهای تخصصی
محققان در پژوهشی جدید نشان دادند که مدلهای زبانی کوچک (Tiny Language Models) با پارامترهای زیر ۳ میلیارد، اگر به درستی آموزش ببینند، میتوانند…
-
🎬 تحولی در سینمای موبایلی: ساخت ویدئوهای حرفهای با هوش مصنوعی روی گوشی!
محققان مدل جدیدی به نام CineMobile را معرفی کردهاند که به گوشیهای هوشمند اجازه میدهد بدون نیاز به قدرت پردازشی سنگین، ویدئوهای سینمایی خیرهکنندهای…
-
🔍 راز درک صدا توسط هوش مصنوعی؛ CLAP چه میبیند؟
محققان در پژوهشی جدید به تحلیل ساختار درونی مدلهای صوتی (Audio Foundation Models) پرداختهاند و نشان دادهاند که چگونه مدل محبوب CLAP ویژگیهای صوتی…
-
🏗 تولید صحنههای سهبعدی واقعی با هوش مصنوعی؛ معرفی CGGS!
تولید محیطهای سهبعدی از دیدگاه شخصی (Ego-centric) همیشه با چالشهایی مثل بههمریختگی هندسی و نبود هماهنگی در زوایای مختلف همراه بوده است. حالا محققان…
-
🛡 راهکار هوشمندانه DualView برای مقابله با حملات تزریق پرامپت (Prompt Injection) در ایجنتهای هوش مصنوعی
آیا میدانستید ایجنتهای هوش مصنوعی که به فایلها، ایمیل و سیستم عامل شما دسترسی دارند، در برابر حملات «تزریق پرامپت غیرمستقیم» چقدر آسیبپذیرند؟ ⚠️…
-
🧠 هوش مصنوعی در درک همزمان صدا و تصویر؛ معرفی معماری جدید Q-TriM!
محققان مدل پیشرفتهای به نام Q-TriM را توسعه دادهاند که انقلابی در حوزهی «پرسش و پاسخ صوتی-تصویری» (AVQA) ایجاد کرده است. مشکل مدلهای قبلی…