محققان در یک پژوهش جدید، روش نوآورانهای برای بهینهسازی مدلهای زبانی بزرگ (LLM) معرفی کردند. تا پیش از این، فشردهسازی مدلها با روشهای سنتی باعث افت کیفیت سریع میشد، اما این راهکار جدید با ترکیب دو روش «هرس کردن پارامترها» و «نادیده گرفتن پویای توکنها»، مرزهای فشردهسازی را جابهجا کرده است.
این یعنی مدلهای هوش مصنوعی در آینده میتوانند با حجم کمتر، هوشمندی و دقت بسیار بالاتری را ارائه دهند. این دستاورد گام بزرگی برای اجرای بهتر مدلهای هوش مصنوعی روی سیستمهای سبکتر است.
منبع: arXiv:2607.18280
سازی
منبع: arXiv AI
