محققان در تازهترین دستاورد خود، متد جدیدی به نام ColGraphRAG را معرفی کردهاند که انقلابی در نحوه تعامل هوش مصنوعی با گرافهای دانش ایجاد میکند. 📊
در مدلهای Multimodal RAG فعلی، معمولاً تصاویر در گرافهای دانش به صورت تکبرداری (Bi-encoder) بررسی میشوند که دقت کافی برای درک جزئیات را ندارد. حالا با تکنیک جدید «تعاملپسین» (Late-Interaction) مشابهِ مدلهای ColBERT، دقتِ بازیابیِ تصاویر و دادههای بصری در سیستمهای پاسخگویی به سوالات (QA) بهطور چشمگیری بهبود یافته است.
این یعنی مدلهای هوش مصنوعی در آینده میتوانند بسیار دقیقتر از قبل، تصاویرِ مرتبط با متون و جداول را در گرافهای پیچیده پیدا کرده و تحلیل کنند. قدمی بزرگ برای هوش مصنوعی که هم «میبیند» و هم «استدلال میکند»! 🧠✨
منبع: arXiv AI
