آیا رباتها میتوانند مثل انسان حرکات پیچیده و طولانیمدت را در دنیای واقعی یاد بگیرند؟ محققان با معرفی MIND-V، یک مدل جهانی (World Model) جدید، به این سوال پاسخ مثبت دادهاند!
این سیستم پیشرفته با الهام از علوم شناختی، سه بخش اصلی دارد:
۱. مرکز استدلال معنایی (برای برنامهریزی وظایف)
۲. پل معنایی رفتاری (برای درک دستورات پیچیده)
۳. مولد ویدیوی حرکتی (برای اجرای دقیق در فضای فیزیکی)
ویژگی جذاب این مدل، استفاده از یادگیری تقویتی (RL) برای اطمینان از رعایت قوانین فیزیک است تا حرکات ربات نه تنها منطقی، بلکه کاملاً واقعی به نظر برسند. این دستاورد، مسیر را برای رباتهای خودمختار که کارهای روزمره پیچیده را بدون نقص انجام میدهند، هموارتر میکند. 🦾✨
منبع: arXiv Computer Vision
