یکی از بزرگترین چالشهای مدلهای زبانی (LLM)، پدیده «توهم» یا همان پاسخهای اشتباه اما با اعتمادبهنفس بالاست. محققان در پژوهش جدیدی متوجه شدهاند که «تجزیه کردن پرامپتها» (Decomposed Prompting) شاید همیشه دقت را بالا نبرد، اما ابزار فوقالعادهای برای تشخیص «عدم قطعیت» مدل است!
در واقع، وقتی مدل از روشهای مختلف به پاسخهای متفاوتی میرسد، احتمالاً در حال حدس زدن است. با استفاده از این تضاد بین پاسخها، میتوان مدل را مجبور کرد تا در صورت نداشتن دانش کافی، به جای هذیان گفتن، صادقانه اعلام کند که «نمیدانم». این یک گام مهم برای افزایش قابلیت اعتماد مدلهای هوش مصنوعی بدون نیاز به آموزش مجدد و هزینههای سنگین است. 🤖✨
منبع: arXiv NLP
