🧠 آیا هوش مصنوعی بالاخره یاد می‌گیرد که «نمی‌دانم» بگوید؟

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

یکی از بزرگترین چالش‌های مدل‌های زبانی (LLM)، پدیده «توهم» یا همان پاسخ‌های اشتباه اما با اعتمادبه‌نفس بالاست. محققان در پژوهش جدیدی متوجه شده‌اند که «تجزیه کردن پرامپت‌ها» (Decomposed Prompting) شاید همیشه دقت را بالا نبرد، اما ابزار فوق‌العاده‌ای برای تشخیص «عدم قطعیت» مدل است!

در واقع، وقتی مدل از روش‌های مختلف به پاسخ‌های متفاوتی می‌رسد، احتمالاً در حال حدس زدن است. با استفاده از این تضاد بین پاسخ‌ها، می‌توان مدل را مجبور کرد تا در صورت نداشتن دانش کافی، به جای هذیان گفتن، صادقانه اعلام کند که «نمی‌دانم». این یک گام مهم برای افزایش قابلیت اعتماد مدل‌های هوش مصنوعی بدون نیاز به آموزش مجدد و هزینه‌های سنگین است. 🤖✨

منبع: arXiv NLP