دسته: arXiv Machine Learning (cs.LG)
-
🚀 پایان دوران «سرد» در سیستمهای توصیهگر؛ معرفی Kairos!
حتماً براتون پیش اومده که وقتی یک خبر جدید منتشر میشه، سیستمهای هوش مصنوعی بهخاطر نبود دادههای کافی (Cold-start) نمیتونن اون رو بهدرستی به…
-
📊 دستیابی به مرزهای جدید در تئوری یادگیری ماشین: کران تعمیم AdaBoost
محققان در مقالهای تازه، تحلیل دقیقتری از عملکرد الگوریتم محبوب «AdaBoost» ارائه دادهاند. این مطالعه به بررسی دقیق «خطای تعمیم» (Generalization Error) پرداخته و…
-
🧠 آیا مدلهای زبانی واقعاً فکر میکنند؟ بررسی مکانیزمهای «تفکر» در هوش مصنوعی
تا حالا فکر کردید وقتی مدلهای زبانی (LLMs) در حالت «تفکر» قرار میگیرند، واقعاً چطور اطلاعات را تحلیل میکنند؟ پژوهش جدیدی روی ۱۰ مدل…
-
🩺 پیشبینی اپیدمیها با قدرت هوش مصنوعی: معرفی TREA-Net!
محققان مدل جدیدی به نام «TREA-Net» طراحی کردهاند که میتواند با استفاده از یادگیری ماشین، شیوع بیماریهایی مثل «دنگی» را در مناطقی که دادههای…
-
🚀 جهش در تولید تصویر با هوش مصنوعی: معرفی Amortized Moment Matching
محققان در جدیدترین دستاورد خود، تکنیک نوآورانهای به نام «تطبیق لحظهای مستهلکشده» (Amortized Moment Matching) را معرفی کردند که دنیای مدلهای مولد (Generative Models)…
-
🤖 آیا همیشه «پیچیدگی» بهتر است؟ درس مهمی برای توسعهدهندگان LLM!
در دنیای هوش مصنوعی، همه فکر میکنند سیستمهای چندعامله (Multi-Agent) لزوماً هوشمندترند. اما پژوهش جدید روی مدل Qwen2.5-7B نشان میدهد که گاهی «سادگی» برنده…
-
🚀 یادگیری هوشمندتر مدلهای جهان با متد جدید Temporally Centered SIGReg! 🌍
محققان در پژوهشی جدید برای حل چالشهای «مدلهای جهان» (World Models)، راهکار خلاقانهای ارائه دادهاند. مدلهای فعلی در یادگیریهای چندوظیفهای (Multi-task) دچار مشکلاتی مثل…
-
🚀 هوش مصنوعی، سریعتر و هوشمندتر در انتخاب معماریهای عصبی!
محققان در مقاله جدید خود به سراغ «جستجوی گروهی عصبی» (NES) رفتهاند تا مشکل پیچیدگی محاسباتی در طراحی شبکههای عصبی را حل کنند. چالش…
-
🔍 تشخیص چهرههای جعلی: آیا مدلهای بیناییِ فعلی به اندازه کافی هوشمندند؟
محققان در مطالعهای جدید به بررسی توانایی مدلهای «بنیادین» (Foundation Models) در تشخیص حملات جعل چهره (PAD) پرداختهاند. این پژوهش سعی دارد پاسخ دهد…
-
🧠 مدلهای هوش مصنوعی چطور قوانین فیزیک را درک میکنند؟
محققان در پژوهشی جدید به سراغ «مدلهای جهانی نهفته» (Latent World Models) رفتند تا بفهمند آیا این مدلها واقعاً فیزیک محیط را درک میکنند…