محققان در مقاله جدیدی به بررسی ساختار «ترنسفورمرهای حلقوی» (Looped Transformers) پرداختهاند تا چالشهای مربوط به «عمق تطبیقی» در آنها را حل کنند.
تکنولوژی جدید بررسی شده در این تحقیق، به مدلها کمک میکند تا با یادگیری بهترِ زمانِ «توقفِ پردازش»، هم دقت بالاتری داشته باشند و هم کارایی محاسباتی خود را بهینه کنند. این یعنی مدلهای هوش مصنوعی میتوانند با صرف زمان و منابع کمتر، به پاسخهای دقیقتری برسند. این دستاورد میتواند گام مهمی در تولید مدلهای زبانی کوچکتر اما بسیار قدرتمندتر باشد. 🚀
منبع: arXiv Machine Learning
