دسته: arXiv AI (cs.AI)
-
🔍 چرا مدلهای آموزشدیده با RL در استدلال ریاضی قویترند؟
پژوهش جدیدی منتشر شده که به بررسی تفاوتهای ساختاری در مغز مدلهای هوش مصنوعی پرداخته است. نتایج نشان میدهد که مدلهایی که با «یادگیری…
-
🕵️♂️ وقتی هوش مصنوعی دروغ میگوید: خطر ناهماهنگی اهداف در سیستمهای چندعامله
محققان در پژوهشی جدید، رفتار مدلهای زبانی را در بازی «گرگینه» (Werewolf) تحلیل کردهاند تا ببینند وقتی هوش مصنوعی اهداف متفاوتی داشته باشد، چطور…
-
🏥 هوش مصنوعی در اتاق معاینه؛ آیا میتوان به تحلیلهای پزشکی مدلها اعتماد کرد؟
محققان بهتازگی بنچمارک جدیدی به نام «ClinLens» را معرفی کردهاند که توانایی مدلهای هوش مصنوعی را در تحلیل دادههای پیچیده پزشکی (مانند سوابق الکترونیک…
-
🔍 چرا بنچمارکهای هوش مصنوعی همیشه قابل اعتماد نیستند؟
تا به حال به این فکر کردید که چطور یک مدل هوش مصنوعی در تستهای بنچمارک عالی عمل میکند، اما در دنیای واقعی یا…
-
🩺 تشخیص دقیقتر بیماریها با هوش مصنوعی؛ معرفی GuideSkill
محققان ابزار هوشمند جدیدی به نام «GuideSkill» طراحی کردهاند که هوش مصنوعی را در دنیای پزشکی متحول میکند! برخلاف مدلهای فعلی که صرفاً متن…
-
🚀 تحولی در تایید خودکار سختافزار با عاملهای هوشمند!
تا به حال به این فکر کردید که چقدر خطاهای کوچک در طراحی تراشهها میتواند هزینهبر باشد؟ محققان بهتازگی چارچوب جدیدی به نام GoGoTB…
-
📊 چرا به رتبهبندیهای فعلی هوش مصنوعی نمیتوان اعتماد کرد؟
آیا تا به حال به نمرات بنچمارک مدلهای زبانی نگاه کردهاید؟ محققان در مقالهای جدید نشان دادهاند که روشهای فعلی امتیازدهی، دچار مشکلی به…
-
🚀 پایان دوران کدهای «جعبهسیاه»؟ معرفی TraceCoder
تا حالا شده از مدلهای هوش مصنوعی برای کدنویسی استفاده کنید و ندانید چرا یک بخش از کد تغییر کرد یا چرا اصلاً شکست…
-
🚀 هوش مصنوعی در خدمت فیزیک نظری: آیا مدلهای زبانی میتوانند کشف علمی کنند؟
محققان در یک پژوهش جدید، توانایی مدلهای زبانی بزرگ (LLM) را برای حل مسائل پیچیده فیزیک آماری بررسی کردهاند. 🧪 در این مطالعه، بنچمارک…
-
🎮 هوش مصنوعی در نقش «مافیا»؛ معرفی CaM-Wolf
بازیهای کسر اجتماعی (Social Deduction Games) مثل «مافیا» یکی از چالشبرانگیزترین حوزهها برای تست هوش مصنوعی هستند، چون ترکیبی از استدلال، فریب و همکاری…