محققان در یک دستاورد جدید، روشی نوآورانه به نام «DINOde» را معرفی کردهاند که فاصله بین متن و تصویر را در مدلهای هوش مصنوعی بهطور چشمگیری کاهش میدهد.
این مدل با استفاده از یک رویکرد مبتنی بر معادلات دیفرانسیل، ویژگیهای بصری قدرتمند مدل DINOv3 را با درک متنی مدل CLIP ترکیب میکند تا درک بهتری از تصاویر (Segmentations) داشته باشد. نتیجه؟ دقت بسیار بالاتر در تفکیک و تشخیص اشیاء، حتی در دستهبندیهایی که قبلاً ندیده است! 🔥
این نوآوری گامی بزرگ برای کاربردهایی مثل خودروهای خودران و تحلیلهای دقیق پزشکی محسوب میشود.
🔗 لینک پروژه: https://github.com/yoon307/DINOde
منبع: arXiv AI
