خیلیها معتقدند آزمونهایی که توسط هوش مصنوعی طراحی میشوند در مقایسه با انسانها، عمق کمتری دارند و به اصطلاح توخالی هستند. اما یک بررسی فنی و دقیق روی این موضوع نشان داده که این باور لزوماً درست نیست!
در این مطالعه جدید، کیفیت و عمق استدلالهای نهفته در تستهای تولید شده توسط AI با تستهای انسانی مقایسه شده و نتایج نشان میدهد که تفاوت معناداری از نظر «توخالی بودن» وجود ندارد. این خبر خوبی برای استفادهکنندگان از ابزارهای هوش مصنوعی در محیطهای آموزشی و ارزیابی است.
نظرتون چیه؟ فکر میکنید هوش مصنوعی میتونه در آینده در طراحی آزمونهای تخصصی جای انسان رو بگیرد؟
منبع: Hacker News AI