🚀 حذف «روتر» در مدل‌های MoE: گامی به سوی بهره‌وری بیشتر! 🧠

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان در یک پژوهش جدید، تکنیک نوآورانه‌ای به نام «Self-Routing» معرفی کرده‌اند که نیاز به لایه «روتر» در مدل‌های Mixture-of-Experts (MoE) را از بین می‌برد.

تا پیش از این، مدل‌های MoE برای هدایت داده‌ها به سمت متخصصان (Experts) به یک روترِ آموزش‌دیده نیاز داشتند، اما در روش جدید، مدل مستقیماً از فضای نهان (hidden states) برای این کار استفاده می‌کند. نتیجه؟ کارایی مشابه با مدل‌های قبلی، اما بدون نیاز به پارامترهای اضافی و با توزیع بار بسیار متوازن‌تر! این یعنی مدل‌های هوش مصنوعی سبک‌تر و بهینه‌تر از همیشه. ⚡️

منبع: arXiv AI