اگر با چالشهای اجرای مدلهای سنگین هوش مصنوعی روی سیستمهای معمولی یا سختافزارهای لبه (Edge) درگیر هستید، این خبر برای شماست!
محققان مدل جدید VibeVoice-ASR-BitNet را معرفی کردهاند که یک نسخه بهینه و بسیار سریع برای پردازش گفتار روی CPU است.
💡 چرا این مدل جذاب است؟
✅ استفاده از تکنیک BitNet برای فشردهسازی وزنی.
✅ اجرای فوقسریع در مقایسه با ابزارهای محبوبی مثل Whisper.cpp (تا ۲.۳ برابر سریعتر!).
✅ طراحیشده برای اجرا روی سیستمهای معمولی با مصرف منابع بسیار پایین (فقط ۳ هسته CPU).
✅ دقت بالا با وجود کاهش حجم چشمگیر مدل.
این یعنی میتوان مدلهای پیشرفته تبدیل گفتار به متن را روی سیستمهایی با توان پردازشی محدود هم با سرعت بالا اجرا کرد.
منبع: arXiv NLP
