مدلهای بزرگ بینایی-زبانی (VLM) معمولاً وقتی با محیطهای جدید روبرو میشوند، دچار افت عملکرد میشوند. حالا محققان فریمورک جدیدی به نام VisCoP معرفی کردهاند که بدون نیاز به بازآموزی سنگین مدل، به آن اجازه میدهد با استفاده از «پروبهای تصویری» یادگیرنده، خودش را با دامنههای جدید (مثل تصاویر سهبعدی یا کنترل رباتیک) سازگار کند.
این روش نه تنها باعث میشود مدل در محیطهای جدید عالی عمل کند، بلکه جلوی «فراموشی فاجعهبار» (Catastrophic Forgetting) دانش قبلی را هم میگیرد! گامی مهم برای هوشمندتر و منعطفتر کردن مدلهای چندوجهی در کاربردهای دنیای واقعی. 🤖✨
منبع: arXiv Computer Vision
