محققان در یک مقاله جدید، راهکار نوآورانهای برای فشردهسازی مدلهای زبانی بزرگ (LLM) ارائه دادهاند. چالش اصلی این مدلها، حجم عظیم پارامترها و نیاز به حافظه بسیار بالاست که عملاً اجرای آنها را روی سیستمهای معمولی غیرممکن میکند.
این روش جدید با ترکیب دو تکنیک «اهمیت نورونی» و «تقریب رتبه پایین (Low-Rank)»، به همراه یک الگوریتم هوشمند برای توزیع بهینه نرخ فشردهسازی در لایهها، توانسته بدون افت کیفیت، حجم مدلها را به شکل قابل توجهی کاهش دهد. این یعنی در آینده نزدیک، مدلهای قدرتمند هوش مصنوعی ممکن است با سرعت و کارایی بیشتری روی دستگاههای شخصی ما اجرا شوند! 📉✨
منبع: arXiv AI
