اگر در دنیای پردازش اسناد (Document Parsing) فعالیت میکنید، خبر مهمی منتشر شده است! مدل جدید «Infinity-Parser2» با رویکردی متفاوت معرفی شد. این مدل با استفاده از یک خط لوله سنتز داده اختصاصی و یادگیری تقویتی چندگانه، توانایی عجیبی در درک ساختار اسناد پیچیده دارد.
ویژگیهای کلیدی:
🔹 انتشار دیتاسِت عظیم ۵ میلیون نمونهای (Infinity-Doc2-5M) با پشتیبانی از زبانهای چینی و انگلیسی.
🔹 دقت فوقالعاده در تحلیل جداول، فرمولهای ریاضی و شیمیایی، نمودارها و چیدمان صفحات.
🔹 ارائه دو نسخه: نسخه Flash برای سرعت بسیار بالا و نسخه Pro برای پروژههای دقیق و حساس.
این مدل موفق شده با ثبت امتیاز ۸۷.۶٪ در بنچمارکها، رقیب قدرتمندی مثل DeepSeek-OCR را پشت سر بگذارد. قدمی بزرگ برای کسانی که با اسناد ساختاریافته و استخراج داده سروکار دارند! 💡📈
منبع: arXiv AI
