محققان در مطالعه جدیدی به مکانیزم شگفتانگیزی دست یافتند که نشان میدهد مدلهای زبانی چگونه مفاهیم پیچیدهای مثل واقعیت، خیال، باورها و زمان را از هم تفکیک میکنند.
این تحقیق نشان میدهد ترنسفورمرها از یک ساختار «روتر» (Router) مشترک برای مدیریت این فضاهای ذهنی استفاده میکنند؛ یعنی مدل با یک فرمت ثابت، محتوا را در اسلاتهای مختلف ذخیره کرده و با تغییر مکاننما، بین دنیای واقعی و فرضی جابهجا میشود.
این کشف بزرگ نه تنها به درک بهترِ نحوه استدلال مدلهای هوش مصنوعی کمک میکند، بلکه راه را برای ساخت مدلهایی با قابلیت درک عمیقتر از منطق انسانی هموار میسازد.
منبع: arXiv Machine Learning
