آیا تزریق تمام متون حقوقی به مدلهای زبانی (LLM) واقعاً بهترین راه است؟ محققان در مقاله جدید خود به سراغ چالش «کارایی توکنها» در اسناد پیچیده حقوقی رفتهاند.
آنها با معرفی دو روش بازیابی نوین (NAVEMBED و NAVINDEX) نشان دادند که میتوان بدون کاهش دقت، مصرف توکنها را تا ۱۷ برابر و هزینهها را تا ۲۵ درصد کاهش داد! این یعنی هوش مصنوعی حالا میتواند با پردازش هوشمندتر، دادههای انبوه را با سرعت و هزینه بسیار کمتر تحلیل کند. 🧠💰
این دستاورد برای شرکتهای حقوقی و تحلیلگران داده که با اسناد طولانی سر و کار دارند، یک گام بزرگ رو به جلو است.
منبع: arXiv NLP
