یکی از چالشهای بزرگ مدلهای زبانی در دنیای پزشکی، ناتوانی در ترکیب درستِ «استدلال منطقی» و «بازیابی اطلاعات معتبر» است. مدلهای فعلی معمولاً یا فقط جستوجو میکنند یا فقط استدلال، که این موضوع باعث خطاهای جدی در تشخیص میشود.
محققان در مقاله جدیدی، مدل Med-R³ را معرفی کردهاند که با استفاده از «یادگیری تقویتی پیشرونده» (Progressive Reinforcement Learning)، این دو بخش را با هم ترکیب میکند. نتیجه؟ مدلی که نه تنها دادهها را دقیقتر پیدا میکند، بلکه در استدلالهای پیچیده پزشکی هم به طرز چشمگیری هوشمندتر عمل میکند و دیگر به تکرار طوطیوارِ مطالب بسنده نمیکند.
این یعنی قدمی بزرگ برای دستیاران هوشمند پزشکان که بتوانند با تکیه بر منابع علمی معتبر، تصمیمات دقیقتری بگیرند! 🧬💡
منبع: arXiv NLP
