آیا سیستمهای بازیابی اطلاعات (RAG) که امروزه در مدلهای زبانی استفاده میکنیم، واقعاً بهینه هستند؟ محققان در پژوهش جدیدی، رویکرد متفاوتی را برای بازرتبهبندی (Reranking) اسناد پیشنهاد دادهاند.
مدل جدید «JKO-RAG» با نگاهی هندسی به موضوع، مفهوم «جریان گرادیان انرژی آزاد» (Wasserstein Free-Energy Gradient Flow) را جایگزین روشهای سنتی کرده است. این مدل برخلاف روشهای فعلی که به صورت لیستهای رتبهبندی ساده عمل میکنند، با درک عمیقتر از هندسه معنایی دادهها، توانسته در تمامی ۵ بنچمارک اصلی، عملکردی بهتر از مدلهای Cross-Encoder ارائه دهد.
این نوآوری نه تنها دقت بازیابی را افزایش میدهد، بلکه با کنترل بهترِ «تغییرات معنایی» (که در بازنویسی سوالها ایجاد میشود)، خروجی دقیقتری را برای مدلهای هوش مصنوعی فراهم میکند. 🤖✨
منبع: arXiv Machine Learning
