محققان در مقاله جدیدی، فریمورک نوآورانهای به نام Penelope معرفی کردهاند که نحوه «استدلال» در مدلهای زبانی را متحول میکند.
مشکل اصلی مدلهای فعلی این است که برای استدلالهای پیچیده یا باید پارامترهای خود را به شدت بزرگ کنند و یا از زنجیره فکری (CoT) طولانی استفاده کنند که سرعت را به شدت کاهش میدهد. Penelope با استفاده از یک حافظه نهان (Latent Memory) و محاسبات بازگشتی در لایههای میانی مدل، بدون نیاز به تولید توکنهای طولانی یا اجرای مکرر کل مدل، استدلال دقیق و بهینهای را ارائه میدهد.
این یعنی در آیندهای نزدیک، دستیارهای هوشمند میتوانند مسائل پیچیده را با هزینه کمتر و سرعت بسیار بالاتر حل کنند! 🧠💡
منبع: arXiv AI



