یکی از بزرگترین چالشهای اجرای مدلهای هوش مصنوعی روی موبایل و دستگاههای شخصی، مصرف انرژی بالا و کندی در پردازش متنهای طولانی است. اما محققان در یک دستاورد تازه، معماری جدیدی به نام «Dolphin» طراحی کردهاند که این مشکل را هوشمندانه حل میکند.
💡 این مدل چطور کار میکند؟
محققان با الهام از مدلهای بینایی-زبانی، متنهای طولانی را به یک «تعبیه حافظه» (Memory Embedding) فشرده تبدیل میکنند. این کار باعث میشود مدل اصلی (۷ میلیاردی) به جای درگیر شدن با حجم عظیم ورودی، فقط با دادههای بهینهشده کار کند.
نتایج فوقالعاده است:
✅ افزایش ۱۰ برابری در بهرهوری انرژی
✅ کاهش ۵ برابری در تاخیر (Latency)
✅ حفظ دقت درک مطلب در متنهای بلند
این پیشرفت یعنی بهزودی میتوانیم دستیارهای هوشمند فوقسریع و بسیار دقیقتری را بدون نیاز به پردازشهای ابری سنگین، مستقیماً روی گوشی خود داشته باشیم! 📱✨
منبع: arXiv NLP
