محققان به راهکار جدیدی برای اجرای مدلهای زبانی بزرگ (LLM) روی گوشیها و دستگاههای لبه (Edge) دست پیدا کردهاند که مشکل همیشگی سرعت و حریم خصوصی را حل میکند.
این روشِ «همکاری لبه-ابر»، بار پردازشی سنگین را تقسیم میکند؛ بخشهای حساس و دادههای کاربر روی دستگاه شما باقی میماند و محاسبات سنگینتر به فضای ابری منتقل میشود. نتیجه؟
✅ کاهش ۴۶ درصدی تاخیر پاسخدهی
✅ کاهش ۶۷ درصدی حجم تبادل داده
✅ حفظ کامل حریم خصوصی با رمزنگاری پیشرفته
با این تکنیک، دیگر برای استفاده از هوش مصنوعیهای قدرتمند، نیازی به قربانی کردن سرعت یا امنیت نداریم! 💡
منبع: arXiv AI
