دنیای سختافزارهای هوش مصنوعی هر روز در حال تحول است! مقاله جدیدی با عنوان «Sparse Attention with Persistent State Machines» منتشر شده که راهکار نوآورانهای را برای افزایش سرعت و کارایی مدلهای زبانی بزرگ (LLM) پیشنهاد میدهد.
این تحقیق با تمرکز بر استفاده از «ماشینهای حالت پایدار» و روش «توجه پراکنده» (Sparse Attention)، به دنبال کاهش فشارهای پردازشی است تا مدلهای قدرتمند بتوانند با بهرهوری بسیار بالاتر روی سختافزار اجرا شوند. این یعنی گامی دیگر به سوی مدلهایی که هم هوشمندترند و هم منابع کمتری مصرف میکنند. 🧠⚡️
منبع: Hacker News LLM