مدلهای زبانی بزرگ (LLM) در کاربردهای پزشکی با چالشهای بزرگی مثل محاسبات پیچیده و چندمرحلهای روبهرو هستند. حالا محققان بنچمارک جدیدی به نام «MedCalc-Pro» را معرفی کردهاند که میتواند مدلهای هوش مصنوعی را در حل مسائل واقعی و پیچیده بالینی به چالش بکشد.
ویژگیهای این دستاورد:
✅ پوشش ۷۷ ماشینحساب تخصصی پزشکی در ۱۴ بخش بالینی.
✅ چارچوب ایجنتی هوشمند برای انتخاب ابزار و محاسبات تو در تو.
✅ کاهش خطاهای محاسباتی از طریق اعتبارسنجی ساختاریافته.
این پیشرفت میتواند مسیر را برای استفاده مطمئنتر از هوش مصنوعی در محیطهای درمانی هموارتر کند. 🩺💻
منبع: arXiv AI
