🧠 آیا مدل‌های زبانی واقعاً «استدلال» می‌کنند یا فقط حافظه‌شان قوی است؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در یک مطالعه جالب، مدل‌های زبانی را با استفاده از «Xiehouyu» (یک نوع بازی زبانی چینی) به چالش کشیدند. نتایج این تحقیق نشان می‌دهد که مدل‌های بزرگ (مثل Gemini 3.1 Pro) در حل مسائل جدید عملکرد خیره‌کننده‌ای دارند، اما وقتی نوبت به «خلاقیت» در ساخت معماهای جدید می‌رسد، هنوز از انسان‌ها عقب هستند.

نکته کلیدی اینجاست: مدل‌های چینی‌زبان به دلیل آموزش روی داده‌های بسیار زیاد، در حفظ کردن این بازی‌ها بهتر عمل می‌کنند، اما این به معنای درک عمیق نیست. این تحقیق به ما یادآوری می‌کند که برای ارزیابی واقعی هوش مصنوعی، باید مراقب چالش «نشت داده» (Data Contamination) باشیم.

آیا فکر می‌کنید هوش مصنوعی روزی می‌تواند در خلاقیت ادبی از ما پیشی بگیرد؟

منبع: arXiv NLP