محققان در مقاله جدیدی، چارچوب نوآورانه «VocaDet» را برای شناسایی و بخشبندی اشیاء (Object Detection & Segmentation) معرفی کردهاند که نیازی به آموزش مجدد مدل ندارد!
🔹 این سیستم چگونه کار میکند؟
به جای تکیه بر متن یا روشهای هزینهبر، VocaDet با تبدیل ویژگیهای بصری به «توکنهای بصری» و ذخیره آنها در یک پایگاه داده برداری (Vector Database)، اشیاء جدید را بر اساس نمونههای ارائهشده توسط کاربر یاد میگیرد. این یعنی شما میتوانید بدون آموزش دوباره مدل، مفاهیم جدیدی را به آن بیاموزید. این مدل با استفاده از قدرت DINOv3، دقت بسیار بالایی در مکانیابی و تفکیک اشیاء ارائه میدهد.
این نوآوری گامی بزرگ برای مقیاسپذیری هوش مصنوعی در محیطهای پویا و در حال گسترش است. 💡
منبع: arXiv Computer Vision
