یکی از بزرگترین چالشهای دنیای رباتیک، سنگین بودن مدلهای هوش مصنوعی و کند بودن آنها در پردازشهای لحظهای است. حالا محققان با معرفی معماری جدید «XS-VLA»، راهکار جذابی برای این مشکل پیدا کردهاند.
این مدل با تکنیکهای پیشرفتهی تقطیر دانش (Distillation)، توانسته است قدرتِ فهمِ فضایی مدلهای بزرگ (مثل Qwen3-VL) را به مدلهای بسیار سبک و کوچک منتقل کند. نتیجه؟ رباتهایی که بدون نیاز به سختافزارهای غولآسا، میتوانند محیط اطراف را درک کرده و کارهای پیچیده را با دقت خیرهکنندهای انجام دهند.
این مدل در بنچمارک LIBERO توانسته مدلهای چندین برابر بزرگتر از خودش را پشت سر بگذارد؛ قدمی بزرگ برای ورود هوش مصنوعیِ واقعی به دستگاههای ساده و ارزانقیمت!
منبع: arXiv Machine Learning
