🚀 آینده رباتیک در دستان «Masked Visual Actions»!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در یک پژوهش جدید، مدل هوشمند و قدرتمندی را برای «مدل‌سازی جهان» (World Modeling) معرفی کرده‌اند که می‌تواند انقلابی در نحوه تعامل ربات‌ها با محیط اطرافشان ایجاد کند. 🤖✨

این مدل با استفاده از رابط کنترل «پیکسل‌-محور»، به ربات‌ها اجازه می‌دهد تا با مشاهده ویدیوها، واکنش‌های فیزیکی را درک و پیش‌بینی کنند. نکته هیجان‌انگیز اینجاست که این مدل تنها با ۱۵ ساعت آموزش، توانسته درک بصری بسیار دقیق و قابلیت کنترل بالایی در سناریوهای متنوع نشان دهد.

به زبان ساده، ربات‌ها حالا می‌توانند حرکات هدف را پیش‌بینی کرده و با شبیه‌سازی نتایجِ کارهایشان، تصمیم‌گیری‌های هوشمندانه‌تری در دنیای واقعی داشته باشند.

منبع: arXiv Computer Vision