محققان در یک دستاورد هیجانانگیز، پارادایم جدیدی به نام «خواب» (Sleep) برای مدلهای زبانی (LLMs) معرفی کردهاند تا مشکل همیشگی آنها در یادگیری مداوم و انتقال دانش کوتاهمدت به حافظه بلندمدت را حل کنند.
این متدولوژی خلاقانه شامل دو مرحله کلیدی است:
۱. تثبیت حافظه (Knowledge Seeding): انتقال دانش از یک مدل کوچکتر به مدل بزرگتر برای حفظ ظرفیت و پایداری اطلاعات.
۲. رویاپردازی (Dreaming): مرحلهای که مدل با استفاده از یادگیری تقویتی (RL)، دادههای مصنوعی تولید میکند تا بدون نیاز به نظارت انسان، خودش را تمرین داده و ارتقا دهد.
این یعنی هوش مصنوعی در حال حرکت به سمت یک ساختار یادگیری مشابه مغز انسان است تا بتواند به صورت پیوسته رشد کند و خود را بهبود ببخشد. 🚀
منبع: arXiv AI
