در دنیای آکادمیک امروز، تقلب با کمک هوش مصنوعی به یک چالش بزرگ تبدیل شده است. پژوهشگران در مقاله جدیدی بررسی کردهاند که آیا خودِ مدلهای زبانی (LLMs) قادرند متون تولید شده توسط خودشان را از نوشتههای واقعی انسانها تشخیص دهند؟
نکات کلیدی این پژوهش:
✅ در کارهای برنامهنویسی و متون طولانی (مثل مقالات تحلیلی)، تشخیص بسیار دقیقتر است.
❌ اما در پاسخهای کوتاه، هوش مصنوعی بهشدت گیج میشود و گاهی حتی خروجیهای خودش را «انسانیتر» از نوشتههای واقعی دانشجوها ارزیابی میکند!
این نتایج نشان میدهد که برای تشخیص هوش مصنوعی از انسان، نمیتوان فقط به خودِ مدلها تکیه کرد و معیارهای متفاوتی برای هر نوع تکلیف نیاز است.
منبع: arXiv NLP
