حتماً میدانید که مدلهای استدلالگر (LRM) قبل از رسیدن به پاسخ نهایی، مسیرهای طولانی از استدلال را طی میکنند. اما مشکل کجاست؟ گاهی این مسیرها پر از اطلاعات اضافه یا تکراری هستند که باعث میشود مدل دچار «توهم» (Hallucination) شود.
محققان بهتازگی چارچوب جدیدی به نام REDE معرفی کردهاند که مثل یک «پاککن هوشمند»، این مسیرهای استدلال را تمیز میکند. با حذف گامهای غیرضروری و نویزها، مدل میتواند پاسخهای دقیقتر و قابلاعتمادتری ارائه دهد. این یک گام مهم برای افزایش دقت هوش مصنوعی در کارهای تخصصی است! 🔍✨
منبع: arXiv AI
