🔍 چرا مدل‌های آموزش‌دیده با RL در استدلال ریاضی قوی‌ترند؟

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

پژوهش جدیدی منتشر شده که به بررسی تفاوت‌های ساختاری در مغز مدل‌های هوش مصنوعی پرداخته است. نتایج نشان می‌دهد که مدل‌هایی که با «یادگیری تقویتی» (RL) آموزش می‌بینند، ساختار درونی منظم‌تر و سلسله‌مراتب عصبی کارآمدتری نسبت به مدل‌های صرفاً آموزش‌دیده (SFT) دارند. این یعنی RL باعث می‌شود مدل‌ها در حل مسائل پیچیده ریاضی، عمیق‌تر و دقیق‌تر عمل کنند. دنیای یادگیری ماشین هر روز پیچیده‌تر و جذاب‌تر می‌شود! 🧠✨

منبع: arXiv AI