پژوهش جدیدی منتشر شده که به بررسی تفاوتهای ساختاری در مغز مدلهای هوش مصنوعی پرداخته است. نتایج نشان میدهد که مدلهایی که با «یادگیری تقویتی» (RL) آموزش میبینند، ساختار درونی منظمتر و سلسلهمراتب عصبی کارآمدتری نسبت به مدلهای صرفاً آموزشدیده (SFT) دارند. این یعنی RL باعث میشود مدلها در حل مسائل پیچیده ریاضی، عمیقتر و دقیقتر عمل کنند. دنیای یادگیری ماشین هر روز پیچیدهتر و جذابتر میشود! 🧠✨
منبع: arXiv AI
