دسته: arXiv NLP (cs.CL)
-
🚀 تولید کدهای باکیفیت؛ معرفی CodeEvo برای ارتقای مدلهای برنامهنویسی
همانطور که میدانید، آموزش مدلهای زبانی برای کدنویسی نیاز به دادههای آموزشی دقیق و پیچیده دارد. اکثر روشهای فعلی به دلیل استفاده از رویکردهای…
-
🧠 هوش مصنوعی در خدمت سلامت روان؛ ارزیابی دقیق مدلهای زبانی برای مشاوره آنلاین
آیا هوش مصنوعی میتواند در تشخیص اولویتبندی ایمیلهای مشاوره روانشناسی به ما کمک کند؟ مطالعه جدیدی که در arXiv منتشر شده، یازده مدل زبانی…
-
🎯 معرفی بنچمارک جدید برای ایجنتهای هوشمند: آیا سیستمهای توصیهگر واقعاً قابل اعتمادند؟
همونطور که ایجنتهای هوش مصنوعی دارن به سمت سیستمهای مکالمهمحور حرکت میکنن، ارزیابی دقیق اونها هم به یک چالش بزرگ تبدیل شده. خیلی از…
-
🛡️ ProvenanceGuard: راهکاری برای جلوگیری از توهم در ایجنتهای هوش مصنوعی!
حتماً برایتان پیش آمده که ایجنتهای هوش مصنوعی (LLM) هنگام استفاده از ابزارهای مختلف، اطلاعات درستی بدهند اما منبع آن را به اشتباه گزارش…
-
🤖 آیا هوش مصنوعی «ایدئولوژی» دارد؟
محققان در یک تحقیق جدید و جذاب ثابت کردند که ایدئولوژی سیاسی مدلهای زبانی (LLM) یک نقطه ثابت نیست، بلکه یک «توزیع احتمالی» است…
-
🛡️ سنجش ایمنی هوش مصنوعی در پزشکی با «MedFailBench»
آیا مدلهای هوش مصنوعی واقعاً در محیطهای بالینی ایمن هستند؟ تا امروز اکثر بنچمارکها فقط روی «درست بودن» پاسخ تمرکز داشتند، اما ابزار جدیدی…
-
🧠 روشی جدید برای ارزیابی هوش مصنوعی: وقتی مدلها به مدلهای دیگر امتیاز میدهند!
محققان در پژوهشی جدید، چارچوب نوآورانهای را برای سنجش مدلهای زبانی بزرگ (LLM) معرفی کردهاند. در این روش، به جای تکیه بر معیارهای ثابت…
-
🔍 مقایسه دقیق هوش مصنوعی و متخصصان انسانی در پزشکی
محققان در پژوهش جدیدی، عملکرد مدلهای زبانی مانند BiomedBERT را در برابر متخصصان انسانی برای دستهبندی مقالات پزشکی (با استفاده از دادههای MeSH) به…
-
🖋️ پایان عصر ابهام در نگارش با هوش مصنوعی! معرفی پلتفرم «Humanly»
یکی از چالشهای بزرگ دنیای امروز، تشخیص محتوای «انساننوشت» از «هوش مصنوعی» است. پلتفرم جدیدی به نام Humanly معرفی شده که این مشکل را…
-
⚖️ آیا هوش مصنوعی قانون کپیرایت را رعایت میکند؟ معرفی Copyright-Bench
محققان در پژوهشی جدید، ابزاری به نام «Copyright-Bench» را معرفی کردهاند که برای اولین بار به طور دقیق رفتار مدلهای زبانی (LLM) را در…