مدلهای زبانی بزرگ (LLM) خیلی سریع در دنیای علم کاربردی شدند، اما یک مشکل بزرگ دارند: دانش آنها به سرعت قدیمی میشود! 📚
محققان به تازگی چارچوب جدیدی به نام ScienceMeter طراحی کردهاند تا دقت مدلهای هوش مصنوعی را در یادگیری مقالات علمی جدید بسنجند. این ابزار سه معیار کلیدی را بررسی میکند:
✅ حفظ دانش قبلی
✅ یادگیری یافتههای جدید
✅ توانایی پیشبینی یا تعمیم به کشفیات آینده
نتایج این ارزیابی نشان میدهد که اگرچه مدلها در یادگیری مطالب جدید عملکرد بدی ندارند، اما هنوز راه زیادی برای رسیدن به دقت ۱۰۰ درصد در بهروزرسانیهای علمی باقی مانده است.
نظر شما چیست؟ آیا هوش مصنوعی میتواند به دستیار قابل اعتماد دانشمندان تبدیل شود؟
منبع: arXiv NLP
