محققان در تازهترین پژوهش خود، مدل نوآورانهای به نام «GARFIELD» معرفی کردهاند که دنیای پیشبینی حرکات (Kinematics) در ویدیوها را متحول میکند.
🔹 این مدل به جای تمرکز بر یک مسیر احتمالی، توزیعی از تمام آیندههای ممکن را در یک فضای نهفته (Latent Space) یاد میگیرد.
چرا این خبر مهم است؟
✅ سرعت ۹۷ برابری در نمونهبرداری از مسیرها نسبت به مدلهای فعلی.
✅ سرعت فوقالعاده در تخمین چگالی حرکت.
✅ مناسب برای برنامهریزیهای دقیق در رباتیک و سیستمهای خودران که نیاز به درک عدم قطعیت محیط دارند.
این مدل ثابت میکند که میتوانیم بدون فدا کردن سرعت، به هوش مصنوعی قدرت «تخیل» مسیرهای مختلف را بدهیم! 🤖✨
منبع: arXiv Computer Vision
