آیا تا به حال در پردازش اسناد طولانی که جداول، نمودارها و متنهای درهمتنیده دارند با مشکل مواجه شدهاید؟ محققان به تازگی فریمورک جدیدی به نام «DOSA» را معرفی کردهاند که به صورت «خود-رگرسیو» و با استفاده از ساختار درختی، اسناد پیچیده را درک میکند.
این مدل با ترکیب ویژگیهای بصری و متنی، روابط سلسلهمراتبی صفحات را شناسایی کرده و برخلاف روشهای سنتی، درک عمیقتری از چیدمان و محتوای اسناد طولانی (Multi-page) ارائه میدهد. نتایج آزمایشها نشان میدهد که DOSA عملکرد فوقالعادهای در استخراج دادههای ساختاریافته دارد و گام بزرگی برای هوشمندتر کردن ابزارهای تحلیل اسناد محسوب میشود. 🚀
منبع: arXiv AI
