محققان در مقاله جدیدی روشی نوآورانه به نام «Re-FORC» معرفی کردهاند که انقلابی در نحوه فکر کردن و استدلال مدلهای زبانی ایجاد میکند.
این روش با پیشبینی دقیق پاداش در حین تولید پاسخ، به مدل اجازه میدهد:
✅ استدلالهای غیرضروری را زودتر متوقف کند (کاهش ۲۶ درصدی هزینههای محاسباتی).
✅ دقت پاسخدهی را با تخصیص هوشمند منابع، تا ۹.۹ درصد افزایش دهد.
✅ تعادلی عالی میان سرعت پاسخدهی و قدرت استدلال مدل ایجاد کند.
این یعنی در آیندهای نزدیک، مدلهای هوش مصنوعی نهتنها باهوشتر میشوند، بلکه سریعتر و بهصرفهتر هم عمل خواهند کرد!
منبع: arXiv AI
