محققان در مطالعه جدید خود، مدل انقلابی BEVLM را معرفی کردهاند که میتواند «استدلال انسانی» مدلهای زبانی (LLM) را با «دید دقیق و فضایی» دوربینهای خودرو ترکیب کند.
این مدل با استفاده از بازنمایی «دید پرنده» (Bird’s-Eye View)، مشکل ناسازگاری تصاویر در خودروهای خودران را حل کرده است. نتایج تستها نشان میدهد که این فریمورک نه تنها دقت استدلال در صحنههای پیچیده رانندگی را تا ۴۶٪ افزایش داده، بلکه عملکرد سیستمهای رانندگی ایمن را تا ۲۸٪ بهبود بخشیده است. گامی بزرگ به سوی خودروهای هوشمندتر و ایمنتر! 🛣️✨
منبع: arXiv AI
