محققان در یک پیشرفت جدید، مدل «UNIVERSE» رو معرفی کردن که دنیای ویدیو و تصمیمگیری در رانندگی خودران رو با هم ترکیب میکنه. برخلاف مدلهای قبلی که بخشهای مختلف رو جدا پردازش میکردن، این سیستم از یک مدل «ترنسفورمر انتشار» (Diffusion Transformer) واحد استفاده میکنه تا پیشبینی ویدیویی و مسیر حرکت (Trajectory) رو با هم آموزش بده.
ویژگی مهم این مدل، سرعت بالای اون در زمان اجراست؛ به طوری که میتونه ۴.۳ برابر سریعتر از مدلهای سنتی عمل کنه، بدون اینکه دقت در رانندگی کاهش پیدا کنه. این یعنی یک گام بزرگ دیگه برای ایمنی و کارایی خودروهای بدون راننده! 🛣️✨
منبع: arXiv Computer Vision
