تا امروز مدلهای هوش مصنوعی برای یادگیری استدلال، به دادههای انسانی یا مدلهای بزرگ زبانی متکی بودند. اما محققان روشی نوآورانه به نام LeAct معرفی کردهاند که به مدلها یاد میدهد از «سیستمهای متخصص» (مثل موتورهای بازیسازی یا اثباتکنندههای ریاضی) استدلال استخراج کنند.
نکته جذاب اینجاست: این سیستمهای متخصص معمولاً فقط عمل نهایی را انجام میدهند بدون اینکه توضیح دهند «چرا» (Chain of Thought). مدل LeAct با بررسی این عملکردها، زنجیره فکریِ نهفته در دل آن اقدامات را کشف و بازسازی میکند.
نتیجه؟ این مدل در بازیها و رباتیک بسیار دقیقتر از روشهای فعلی عمل کرده و راه جدیدی برای آموزش هوش مصنوعی بدون نیاز به دیتای انسانی باز کرده است. تحولی جذاب در دنیای آموزش مدلهای هوش مصنوعی! 🚀
منبع: arXiv AI
