محققان در مقاله جدیدی از روشی به نام «SpanUQ» رونمایی کردند که چالش قدیمی «عدم قطعیت» در خروجی مدلهای هوش مصنوعی را هدف قرار داده است.
مشکل چیست؟ تا امروز، اکثر روشهای بررسی دقت مدلها یا خیلی کلی بودند (سطح جمله) و یا خیلی جزئی (سطح توکن) که عملاً باعث گمراهی میشد. SpanUQ با تمرکز بر «بخشهای معنادار متن» (Span-Level)، به مدلها کمک میکند تا دقیقاً بفهمند در کجای جملات خود احتمال خطا وجود دارد.
ویژگیهای کلیدی این ابزار جدید:
✅ تشخیص هوشمند و دقیقِ بخشهای معنادار متن.
✅ سرعت فوقالعاده؛ ۱۰ تا ۲۰ برابر سریعتر از روشهای نمونهبرداری فعلی.
✅ دقت بسیار بالاتر در مقایسه با ابزارهای مشابه.
این پیشرفت میتواند به توسعه مدلهای هوش مصنوعیِ قابلاعتمادتر (Trustworthy AI) کمک بزرگی کند تا در کاربردهای حساس، کمتر دچار «توهم» یا خطای منطقی شوند.
منبع: arXiv NLP
