آیا مدلهای زبانی بزرگ (LLM) واقعاً ارزشهای انسانی را درک میکنند یا فقط کلمات را کنار هم میچینند؟ محققان برای پاسخ به این پرسش، بنچمارک جدیدی به نام «D2VBench» طراحی کردهاند.
این ابزار شامل ۱۰ هزار سناریوی واقعی از چالشهای اخلاقی روزمره است که به مدلها کمک میکند تا در موقعیتهای حساس و متناقض، خروجیهای دقیقتر و اخلاقیتری ارائه دهند. این بنچمارک با ترکیب سوالات چندگزینهای و تشریحی، ابزاری قدرتمند برای ارزیابی «همسویی ارزشی» (Value Alignment) مدلهای هوش مصنوعی فراهم کرده است. 🧠⚖️
منبع: arXiv NLP
