⚡️ آیا پردازنده موبایل شما برای اجرای LLMها آماده است؟ 📱🤖

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

اجرای مدل‌های زبانی بزرگ (LLM) روی گوشی‌ها نه تنها حریم خصوصی را حفظ می‌کند، بلکه سرعت پاسخ‌دهی را هم بالا می‌برد. اما چالش اصلی اینجاست: چرا عملکرد سخت‌افزارهای مختلف مثل NPUها اینقدر متفاوت است؟

محققان در پژوهش جدیدی با ابزار «PowerBench» به نتایج جالبی رسیدند:

1️⃣ شکاف عملکرد در NPUها بسیار بیشتر از آن چیزی است که فکر می‌کردیم (گاه تا ۱۰ برابر!).
2️⃣ پردازنده‌های NPU در مرحله Pre-filling (پیش‌پرکردن) عالی هستند، اما در مرحله Decoding (تولید متن)، همچنان CPUها پیروز میدان‌اند.
3️⃣ تنظیمات بهینه سخت‌افزاری می‌تواند تا ۴۰٪ از اتلاف انرژی جلوگیری کند.

این تحقیق نقشه راهی برای توسعه‌دهندگان ارائه داده تا با تنظیم دقیق ناهماهنگی‌های سخت‌افزاری، هوش مصنوعی را روی موبایل‌ها بهینه‌تر و کم‌مصرف‌تر اجرا کنند. آینده هوش مصنوعی در جیب‌های ما در حال بهینه‌شدن است! 🚀

منبع: arXiv AI