یکی از بزرگترین چالشهای هوش مصنوعی، ارائه پاسخهای قاطع اما غلط توسط مدلهای زبانی است. حالا محققان چارچوب جدیدی به نام «Evidence Chain Evaluation» یا همان ECE را معرفی کردهاند که به مدل اجازه میدهد به جای حدس زدنِ کورکورانه، در صورت ضعیف بودنِ شواهد، از پاسخدهی خودداری کند.
این روش با ارزیابی زنجیرهایِ مدارک و استفاده از ابزارهای جستجوی وب و دادههای علمی، دقت فکتچکینگ را به شکل چشمگیری افزایش میدهد. در واقع، این یعنی هوش مصنوعی یاد میگیرد که بگوید «نمیدانم» یا «شواهد کافی ندارم»، که گام مهمی در جهت ایمنی و اعتمادپذیری بیشتر در دنیای LLMهاست. 🛡️🤖
منبع: arXiv AI
