در یک تحقیق جالب، محققان بررسی کردند که وقتی مدلهای زبانی شطرنج بازی میکنند، آیا واقعاً در فضای پنهان خود «فکر» میکنند یا صرفاً به وزنهای عصبی تکیه دارند؟
نتایج این آزمایش نشان میدهد که برخلاف تصور رایج، یادگیری تقویتی (RL) باعث نمیشود مدلها لزوماً به «محتوای فکری» خود در لایههای پنهان وابستهتر شوند، بلکه بیشتر باعث افزایش مقاومت مدل در برابر اختلالات میشود. این یعنی هوش مصنوعی در مسیر رسیدن به پاسخ درست، استراتژیهای متفاوتتری از آنچه تصور میکردیم به کار میگیرد! ♟️🤖
منبع: arXiv Machine Learning
