محققان در یک مطالعه جالب، مدلهای زبانی را با استفاده از «Xiehouyu» (یک نوع بازی زبانی چینی) به چالش کشیدند. نتایج این تحقیق نشان میدهد که مدلهای بزرگ (مثل Gemini 3.1 Pro) در حل مسائل جدید عملکرد خیرهکنندهای دارند، اما وقتی نوبت به «خلاقیت» در ساخت معماهای جدید میرسد، هنوز از انسانها عقب هستند.
نکته کلیدی اینجاست: مدلهای چینیزبان به دلیل آموزش روی دادههای بسیار زیاد، در حفظ کردن این بازیها بهتر عمل میکنند، اما این به معنای درک عمیق نیست. این تحقیق به ما یادآوری میکند که برای ارزیابی واقعی هوش مصنوعی، باید مراقب چالش «نشت داده» (Data Contamination) باشیم.
آیا فکر میکنید هوش مصنوعی روزی میتواند در خلاقیت ادبی از ما پیشی بگیرد؟
منبع: arXiv NLP
