تولید استدلالهای ریاضی دقیق توسط هوش مصنوعی، همیشه با چالش «خطاهای معنایی» روبرو بوده است. اکثر سیستمها فقط یک پاسخ «درست یا غلط» میدهند که کمکی به فهم دلیل خطا نمیکند.
حالا محققان با معرفی چارچوب FormalRx، این جعبه سیاه را باز کردهاند! 🔍
ویژگیهای کلیدی این ابزار:
✅ دستهبندی دقیق خطاها در ۲۸ گروه مختلف با استفاده از تاکسونومی اختصاصی SCI.
✅ قابلیت تشخیص، مکانیابی و حتی اصلاح خطاهای مدل.
✅ مدل FormalRx-8B توانسته عملکردی بهمراتب بهتر از مدلهای عمومی و تخصصی فعلی داشته باشد.
این یعنی هوش مصنوعی در حل مسائل پیچیده ریاضی و استدلالهای منطقی، یک قدم بزرگ به سمت دقت حداکثری برداشته است. این ابزار برای توسعهدهندگانی که روی مدلهای ریاضی و منطقی کار میکنند، یک تحول مهم محسوب میشود. 📐🔢
منبع: arXiv NLP
