🚀 جهش در کارایی مدل‌های زبانی: معرفی Nemotron-Labs-3-Puzzle-75B-A9B!

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان انویدیا مدل فشرده و فوق‌بهینه جدیدی به نام «Puzzle-75B-A9B» را معرفی کرده‌اند که دنیای استقرار مدل‌های بزرگ (LLM) را متحول می‌کند. این مدل که نسخه‌ای بهینه‌سازی‌شده از Nemotron-3 است، با تکنیک‌های پیشرفته‌ای مثل فشرده‌سازی MoE، تقطیر دانش (Knowledge Distillation) و یادگیری تقویتی ساخته شده است.

چرا این خبر مهم است؟
✅ افزایش ۲ برابری توان عملیاتی سرور (Throughput) برای سرویس‌دهی تعاملی.
✅ افزایش چشمگیر ظرفیت پردازش متون طولانی (تا ۸ برابر در محیط‌های واقعی).
✅ حفظ دقت بالا در کنار کاهش چشمگیر هزینه‌های محاسباتی.

این دستاورد نشان می‌دهد که آینده هوش مصنوعی در گروِ مدل‌های سبک‌تر، اما همچنان قدرتمند است که می‌توانند روی سخت‌افزارهای محدودتر، عملکردی در سطح مدل‌های غول‌پیکر ارائه دهند. 💡

منبع: arXiv AI