محققان در پژوهش جدیدی فریمورک جذابی به نام ILR معرفی کردهاند که نحوه یادگیری مدلهای زبانی (LLM) در سیستمهای چندعاملی را متحول میکند.
در اکثر سیستمهای فعلی، مدلها باید برای حل مسائل پیچیده دائماً با هم تعامل کنند، اما این روش جدید با الهام از تفکر انسانی، به مدلها یاد میدهد که چگونه از طریق تعامل با دیگران، به «استقلال در حل مسئله» برسند.
این فریمورک با استفاده از استراتژیهای هوشمندانه برای انتخاب نوع همکاری (رقابتی یا مشارکتی) و تکنیکهای جدید کالیبراسیون ادراک، توانایی استدلال مدلها را به شکل چشمگیری در ریاضیات و کدنویسی بهبود میبخشد.
آینده سیستمهای چندعاملی روشنتر از همیشه به نظر میرسد! 🚀
منبع: arXiv AI
