محققان در یک پژوهش جدید، به سراغ بهینهسازی مدلهای «شناسایی موجودیتهای نامدار» (NER) رفتهاند. مدل جدیدی به نام Otter معرفی شده که با وجود حجم بسیار کمتر نسبت به مدلهای عظیم زبانی (LLMs)، عملکردی خیرهکننده در بیش از ۱۰۰ زبان مختلف دارد.
نکته جالب اینجاست که این مدل با بررسی دقیق معماریهای ترنسفورمر و روشهای آموزشی، توانسته ۵.۳ درصد دقت بیشتری نسبت به مدلهای همرده خود کسب کند. این یعنی گامی موثر به سوی مدلهای چندزبانه کارآمدتر و دقیقتر برای پردازش متن! 📝✨
منبع: arXiv NLP
