محققان در پژوهشی تازه، روش نوآورانهای به نام «MedDDC-Eval» را معرفی کردهاند که تحولی در ارزیابی ایجنتهای مشاور پزشکی ایجاد میکند. تا پیش از این، ارزیابی مدلها به دلیل ترکیب «کیفیت تاریخچه بیمار» و «تشخیص نهایی» دچار خطا میشد، اما این بنچمارک جدید با جداسازی این دو فرآیند، دقت تشخیص را به طور واقعیتری میسنجد.
این ابزار نه تنها کیفیت جمعآوری اطلاعات توسط هوش مصنوعی را به چالش میکشد، بلکه با استفاده از الگوریتم GRPO برای آموزش مدل Qwen3، گام مهمی در جهت بهبود دقت و کارایی دستیاران پزشکی هوشمند برداشته است. این پیشرفت میتواند در آینده به پزشکان و بیماران برای دریافت مشاوره دقیقتر و سریعتر کمک شایانی کند. 🩺🤖✨
منبع: arXiv AI
