دسته: arXiv AI (cs.AI)
-
🚀 ارتقای توانایی استدلال مدلهای چندوجهی (Multimodal) با یادگیری تقویتی
محققان روش جدیدی به نام O2-CritiCuRL معرفی کردهاند که مشکل رایج مدلهای زبانی چندوجهی را حل میکند؛ این مدلها گاهی به پاسخ درست میرسند…
-
🚀 معیار جدید برای ارزیابی هوش مصنوعیهای عاملمحور (Agentic AI) معرفی شد!
محققان ابزار جدیدی به نام E-Bench را برای سنجش توانایی مدلهای زبانی در انجام کارهای چندمرحلهای و کار با ابزارها در محیطهای دنیای واقعی…
-
🚀 معرفی مدلهای هوش مصنوعی با قابلیت کنترل در زمان استنتاج (CALM)!
تا امروز مدلهای زبانی معمولاً برای یک الگوی خاص آموزش میدیدند، اما حالا با فریمورک جدید CALM (Controller-Aware Language Models)، مدلها یاد میگیرند که…
-
🚀 تحولی جدید در خودآموزی مدلهای زبانی: معرفی RLSVR
تا امروز، تقویت مدلهای هوش مصنوعی (RLVR) عمدتاً محدود به حوزههایی مثل ریاضی و کدنویسی بود، چون این کارها جوابهای مشخص و قابل تأیید…
-
🧠 مدیریت هوشمند حافظه برای ایجنتهای پیشرفته: معرفی ACM
آیا تا به حال به این فکر کردید که ایجنتهای هوش مصنوعی چطور در کارهای طولانیمدت، جزئیات مهم را فراموش نمیکنند؟ محققان چارچوب جدیدی…
-
🤖 فراتر از متن و صدا؛ هوش مصنوعی حالا «زبان بدن» را هم میفهمد!
تا به حال دقت کردهاید که چقدر از مکالمات ما در «حرکات چشم»، «حالت چهره» و «اشارههای دست» نهفته است؟ در تعاملات انسانی، وقتی…
-
🧠 چرا ما انسانها در حل مسائل پیچیده هوشمندانه عمل میکنیم؟
تحقیق جدیدی در arXiv منتشر شده که شباهتهای عملکردی بین انسان و هوش مصنوعی در حل مسائل «بهینهسازی ترکیبی» (مثل مسئله فروشنده دورهگرد –…
-
🧪 هوش مصنوعی در خدمت کشف مواد: بهینهسازی مسیر آزمایشها با کمترین هزینه!
محققان در مقالهای جدید، روشی نوآورانه برای آزمایشگاههای خودکار (Autonomous Labs) معرفی کردهاند که به هوش مصنوعی اجازه میدهد مسیرهای بهینه را در کشف…
-
🚀 بهینهسازی خیرهکننده در مدلهای بینایی-زبانی (VLM) با روش GOTS
مدلهای پیشرفته بینایی-زبانی (VLM) مثل Qwen-VL یا InternVL برای پردازش تصاویر با رزولوشن بالا، حجم بسیار زیادی «توکن بصری» تولید میکنند که پردازش آنها…
-
🧠 MemTX: قدمی بزرگ برای امنیت ایجنتهای هوش مصنوعی!
تا حالا فکر کردید اگر یک ایجنت هوش مصنوعی اطلاعات اشتباهی رو در حافظه اشتراکی ثبت کنه، چه فاجعهای میتونه به بار بیاره؟ 😱…