مدلهای بینایی-زبان-عمل (VLA) که مغز متفکر رباتهای امروزی هستند، معمولاً به دلیل سنگین بودن، با تاخیر زیادی اجرا میشوند. اما حالا محققان با معرفی چارچوب جدیدی به نام VQVLA، راهکار خلاقانهای برای این مشکل پیدا کردهاند!
این فناوری جدید با استفاده از «کوانتیزاسیون هوشمند حرکتی»، میزان دقت محاسبات را بر اساس وضعیت حرکت ربات تنظیم میکند و باعث میشود پردازشها تا چندین برابر سریعتر از کارت گرافیکهای قدرتمندی مثل A100 انجام شود. این یعنی رباتها در آیندهای نزدیک میتوانند با سرعت و دقت بسیار بیشتری در دنیای واقعی فعالیت کنند. 🤖💨
منبع: arXiv AI
