🚀 فشرده‌سازی مدل‌های زبانی با روشی هوشمندتر: معرفی TriSP

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

یکی از بزرگترین چالش‌های دنیای هوش مصنوعی، سنگین بودن مدل‌های زبانی (LLMs) و هزینه بالای اجرای آن‌هاست. محققان به تازگی روشی به نام «TriSP» معرفی کرده‌اند که می‌تواند مدل‌های بزرگ را بدون افت محسوس عملکرد، به شکل چشمگیری بهینه و کوچک کند!

💡 چرا این خبر مهم است؟
روش TriSP با ترکیب هوشمندانه وزن‌ها، گرادیان‌ها و فعال‌سازها، اجازه می‌دهد مدل‌هایی مثل LLaMA-7B با حجم کمتر، بسیار سریع‌تر اجرا شوند (تا ۸۲٪ افزایش سرعت در ۵۰٪ هرس مدل). این یعنی در آینده نه چندان دور، اجرای مدل‌های قدرتمند روی سخت‌افزارهای معمولی بسیار آسان‌تر خواهد شد.

منبع: arXiv AI