یک تحقیق جالب در حوزهی فیزیک و اخترشناسی نشان داده که مدلهای زبانی (مثل ChatGPT و Claude) در نگارش پروپوزالهای پژوهشی دستکمی از انسانها ندارند! 🧪🔭
نکات کلیدی این مطالعه:
✅ داورهای انسانی به پروپوزالهای هوش مصنوعی نمرهای مشابه با کارهای انسانی دادند.
✅ هوش مصنوعی در تشخیص متونِ نوشته شده توسط خودش، عملکرد ۱۰۰ درصدی داشت (یعنی کاملاً متوجه سبک همنوعانش شد!).
✅ نکته تاملبرانگیز اینجاست که داورهای هوش مصنوعی، به پروپوزالهای هوش مصنوعی نمرات بالاتری نسبت به کارهای انسانی دادند که نشاندهنده یک سوگیری سیستماتیک است.
این نتایج به ما هشدار میدهد که در استفاده از هوش مصنوعی برای ارزیابیهای علمی حساس، باید هوشمندانهتر و با احتیاط بیشتری عمل کنیم. نظر شما چیه؟ به نظرتون هوش مصنوعی میتونه در آینده جای دانشمندان رو در طراحی پروژهها بگیره؟ 🤔
منبع: arXiv NLP
