🧠 چرا مدل‌های هوش مصنوعی «توهم» می‌زنند؟ کشف تفاوت دانش و بیان در LLMها

⚠️ هشدار به محققان: چرا دقت مدل‌های شناسایی پهپاد گاهی «واقعی» نیست؟

محققان در مطالعه‌ای جدید به یک نکته کلیدی در دنیای مدل‌های زبانی بزرگ (LLM) دست یافتند: تفاوت بین «آنچه مدل می‌داند» و «آنچه مدل بیان می‌کند»! 🧐

تا امروز فکر می‌کردیم شاید مدل‌ها کلاً پاسخ مسئله را نمی‌دانند، اما این تحقیق نشان می‌دهد که «دانشِ حل مسئله» و «نحوه بیان آن» در لایه‌های پنهان مدل به صورت دو ویژگی مجزا ذخیره می‌شوند. در واقع، بسیاری از توهمات (Hallucinations) مدل‌ها ناشی از تغییر در نحوه بیان است، نه نقص در دانش اصلی آن‌ها! 💡

این کشف جذاب راه را برای کنترل بهتر مدل‌ها باز می‌کند تا با دستکاری مستقیم این لایه‌های پنهان، بتوانیم احتمال اشتباهات و «توهم‌زدن» مدل‌ها را به حداقل برسانیم و آن‌ها را در حل مسائل ریاضی دقیق‌تر کنیم. گامی بزرگ به سوی مدل‌های قابل‌اعتمادتر! 🚀

منبع: arXiv Machine Learning