🚀 انقلاب در سخت‌افزار هوش مصنوعی: معرفی معماری ThAME برای سرعت بخشیدن به مدل‌های MoE

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

مدل‌های بزرگ زبانی (LLM) با معماری «ترکیب کارشناسان» (MoE) پادشاهان فعلی دنیای هوش مصنوعی هستند، اما اجرای آن‌ها همیشه با چالش‌های سنگینی مثل کندی حافظه و ترافیک داده مواجه بوده است.

محققان در یک پژوهش جدید، معماری سه‌بعدی نوآورانه‌ای به نام ThAME معرفی کرده‌اند که با ترکیب فناوری‌های پیشرفته حافظه (مثل FeFET) و طراحی خاص شبکه روی تراشه، توانسته است عملکرد اجرای مدل‌های MoE را تا ۱۵.۷ برابر سریع‌تر و ۹.۸ برابر بهینه‌تر از سخت‌افزارهای فعلی کند! این یعنی راه برای اجرای مدل‌های عظیم‌تر روی سخت‌افزارهای کم‌مصرف‌تر هموارتر شد.

منبع: arXiv AI