یک مطالعه جدید و جذاب روی عملکرد مدلهای زبانی بزرگ (LLM) در حوزههای فیزیک و کیهانشناسی منتشر شده که نتایج جالبی داره:
🔹 در بررسیهای سال ۲۰۲۵، هوش مصنوعی در پیدا کردن منابع علمی تفاوت زیادی با متخصصان انسانی داشت (تنها ۶٪ همپوشانی!) و متأسفانه نرخ خطای «توهم» و اطلاعات نادرست در متادیتای مقالات بالا بود.
✅ اما خبر خوب: در مدلهای جدیدتر (۲۰۲۶) مثل ChatGPT Pro 5.5، این وضعیت به طرز چشمگیری بهبود پیدا کرده و دقت در استناد به مقالات به شکل قابلتوجهی بالا رفته.
نتیجهگیری: فعلاً هوش مصنوعی یک دستیار عالی برای تحقیقاته، اما جایگزینِ «تخصص انسانی» در بررسیهای دقیق علمی نیست. همیشه منابع ارائهشده توسط هوش مصنوعی رو دوباره چک کنید! 🔍
منبع: arXiv NLP
