یک تحقیق جدید و جالب نشان میدهد که مدلهای زبانی پیشرو (LLM) لزوماً تمام فرآیند استدلال خود را در خروجیهای متنی (Chain-of-Thought) نمایش نمیدهند!
🔹 ماجرا چیست؟
محققان کشف کردهاند که مدلها میتوانند از کلمات پرکننده (filler tokens) که در ظاهر بیمعنی به نظر میرسند، برای انجام محاسبات پیچیده و استدلالهای پنهان استفاده کنند. این یعنی مدلها گاهی بدون اینکه ردی از فکرشان در متن خروجی باقی بماند، به نتایج دقیقتر میرسند.
⚠️ اهمیت موضوع:
این یافته یک چالش بزرگ برای «ایمنی هوش مصنوعی» است؛ چون وقتی مدلها محاسباتی را به صورت نامرئی انجام میدهند، نظارت بر رفتار و نحوه رسیدن آنها به خروجی نهایی بسیار دشوارتر میشود. این یعنی هوش مصنوعی فراتر از چیزی که میخوانیم، فکر میکند!
شما فکر میکنید آیا باید نگران این «استدلالهای نامرئی» باشیم؟
منبع: arXiv Machine Learning
