حتماً شنیدهاید که مدلهای هوش مصنوعی گاهی اوقات پس از مدت طولانی آموزش، ناگهان «جهش» بزرگی در یادگیری و تعمیمدهی پیدا میکنند؛ پدیدهای که به آن Grokking میگویند. حالا محققان در یک مطالعه جدید، مکانیزم دقیق ریاضی این اتفاق را کشف کردهاند! 🧠
این مقاله علمی توضیح میدهد که چگونه «وزندهی» و «بهینهسازها» در مدلها باعث میشوند مدل در نهایت به جای حفظ کردن دادهها، الگوها را واقعاً درک کند. این دستاورد میتواند راه را برای آموزش مدلهای دقیقتر و هوشمندتر با مصرف منابع بهینهتر هموار کند. 📈
منبع: arXiv Machine Learning
