مدلهای یادگیری خودنظارتی (SSL) که امروزه ستون اصلی آموزش مدلهای بینایی ماشین هستند، اغلب با چالش «نگاشت یکبهچند» دستوپنج نرم میکنند. به زبان ساده، وقتی هوش مصنوعی با دادههای متوالی (مثل فریمهای ویدیو) روبرو میشود، تشخیص دقیق روابط پیچیده دشوار است.
محققان در مقاله جدیدی روشی به نام AdaSSL را معرفی کردهاند که با استفاده از «متغیرهای پنهان» و یک قید ریاضی جدید، به مدل کمک میکند تا عدم قطعیت دادهها را بهتر درک کند. این روش نه تنها در مدلهای کنتراستی، بلکه در مدلسازی دنیای واقعی و درک جزئیات تصاویر نیز عملکرد بسیار بهتری از خود نشان میدهد. گامی دیگر به سمت مدلهایی با درک بصری عمیقتر! 🚀
منبع: arXiv Machine Learning
