یکی از بزرگترین چالشهای هوش مصنوعی، «توهم» (Hallucination) یا تولید پاسخهای غلط با اطمینان کاذب است. حالا محققان در یک دستاورد تازه، شاخصی به نام D-Score را معرفی کردهاند که به جای نیاز به ابزارهای جانبی، از دلِ خودِ مدل بیرون میآید!
این روش با تحلیل هندسی و آماری وضعیتهای پنهان (Hidden States) مدل در یک مرحله پردازش، تشخیص میدهد که آیا مدل در حال گفتن یک واقعیت است یا دچار توهم شده. مزیت اصلی این روش این است که نیازی به جستجو در دیتابیسهای خارجی یا تولید چندین پاسخ ندارد و بسیار سبک طراحی شده است.
گامی بلند برای واقعیتر شدن چتباتها و دستیارهای هوشمند! 🚀
منبع: arXiv NLP



