🚀 تحولی در اجرای مدل‌های زبانی روی اپل: معرفی BaseRT

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

خبر هیجان‌انگیز برای طرفداران اکوسیستم اپل! محققان با معرفی فریم‌ورک «BaseRT» موفق شدند رکورد سرعت اجرای مدل‌های زبانی بزرگ (LLM) را روی تراشه‌های نسل جدید Apple M5 جابه‌جا کنند.

این ابزار با بهره‌گیری هوشمندانه از واحدهای «Neural Accelerator» در تراشه‌های M5، توانسته سرعت پردازش درخواست‌ها (Prompt Processing) را تا ۶.۴ برابر نسبت به llama.cpp افزایش دهد! این یعنی مدل‌های سنگینی مثل Llama 3.2 یا Qwen حالا روی دیوایس‌های اپل با سرعتی باورنکردنی اجرا می‌شوند. این دستاورد عملاً یک استاندارد جدید برای دنیای «On-Device AI» محسوب می‌شود. ⚡️🍎

منبع: arXiv Machine Learning