محققان به تازگی در مقالهای با معرفی دیتاست جدید «CUP»، عملکرد مدلهای مختلف را در جستجو و بازیابی کتابهای زبان یونانی ارزیابی کردهاند. نتایج این تحقیق نشان میدهد که ترکیب روشهای کلاسیک (مانند BM25) با مدلهای زبانی پیشرفته (Hybrid Retrieval)، بهترین نتیجه را برای پاسخ به پرسشهای چندزبانه و معنایی ارائه میدهد.
این تحقیق گام مهمی در بهبود موتورهای جستجوی تخصصی و درک بهتر محدودیتهای مدلهای زبانی در مواجهه با زبانهای غیرانگلیسی و دادههای «نویزدار» است. 🔍✨
منبع: arXiv AI
