آیا تا به حال فکر کردهاید که چرا مدلهای هوش مصنوعی (LMMs) گاهی در درک ساختارهای درختی یا روابط مفهومیِ پیچیده دچار اشتباه میشوند؟ محققان بهتازگی راهکار جدیدی به نام HiR² را معرفی کردهاند که به مدلهای چندوجهی کمک میکند مفاهیم را بهصورت «خوشهبندی سلسلهمراتبی» بهتر درک کنند.
این ابزار هوشمند با استفاده از یک معماری جدید، روابط بین مفاهیم را از لایههای میانی مدلهای زبانی استخراج کرده و دقت تشخیص بصری را بهطرز چشمگیری افزایش میدهد. این یعنی مدلهای آینده، درک بسیار دقیقتر و منطقیتری از دنیای پیرامون خود خواهند داشت!
💻 برای مشاهده جزئیات فنی و کدهای پروژه میتوانید به صفحه گیتهاب این تیم پژوهشی سر بزنید.
منبع: arXiv AI
