مدلهای زبانی (LLM) حالا به دستیاران هوشمندی برای سلامت روان تبدیل شدهاند، اما چطور بفهمیم واقعاً چقدر دقیق و امن هستند؟ 🤔
محققان چارچوب جدیدی به نام «CARE-MH» معرفی کردهاند که به دنبال ایجاد یک استاندارد واحد برای ارزیابی «همدلی»، «ایمنی» و «مناسب بودنِ» پاسخهای این مدلهاست. این تحقیق نشان میدهد که بسیاری از معیارهای فعلی قابل بازتولید نیستند و این فریمورک راهکاری برای مقایسه دقیقتر و علمیتر مدلها در این حوزه حساس است. 🧠✨
منبع: arXiv AI
