🧠 آیا ترنسفورمرها واقعاً می‌توانند «استدلال» کنند؟ معرفی ROUTEBENCH!

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

محققان در تازه‌ترین پژوهش خود به بررسی این موضوع پرداختند که آیا ترنسفورمرها می‌توانند استراتژی‌های حل مسئله را بر اساس نوع داده تغییر دهند یا خیر. آن‌ها برای این کار از «مسیریابی الگوریتم نهفته» (Latent Algorithm Routing) استفاده کرده و بنچمارک جدیدی به نام ROUTEBENCH را معرفی کرده‌اند.

نتایج نشان می‌دهد که مدل‌های ترنسفورمر با پارامترهای بهینه، توانایی چشمگیری در انتخاب استراتژی حل مسئله (مثل مدل‌های ریاضی مختلف) بسته به ماهیت مسئله دارند؛ حتی زمانی که فرمت سوالات تغییر می‌کند! این گامی مهم برای درک بهتر نحوه یادگیری و استدلال مدل‌های زبانی است. 🚀

منبع: arXiv NLP