محققان در پژوهشی جدید به سراغ حل یکی از چالشهای بزرگ در پردازش متون تاریخی رفتند: خواندن دستنوشتههای لاتین قرون وسطی! این مطالعه نشان میدهد که برای کارهای تخصصی مثل تحلیل متون باستانی، همیشه مدلهای غولپیکر (VLM) بهترین گزینه نیستند.
نتایج این تحقیق ثابت کرد که ترکیب «مدلهای OCR تخصصی» با مدلهای زبانی، خروجی دقیقتری نسبت به روشهای پیچیده بازیابی اطلاعات (RAG) دارد. این یعنی گاهی سادگی و تخصصیسازی، کلید موفقیت در دنیای هوش مصنوعی است. همچنین در این پروژه، مجموعه داده جدیدی به نام IPC شامل بیش از ۱۳۰۰ تصویر و ترجمه تخصصی برای کمک به محققان آینده معرفی شده است. 💡
منبع: arXiv AI
