تا حالا حس کردید مکالمه با هوش مصنوعی هنوز کمی ماشینی و غیرطبیعی است؟ با اینکه مدلهای صوتی پیشرفت زیادی کردهاند، اما هنوز در درکِ دقیقِ زمانبندی، احساسات، لحن و نوبتگیری در گفتگو مشکل دارند.
محققان به تازگی بنچمارک جدیدی به نام SPEARBench را معرفی کردهاند. این معیار به جای تمرکز صرف بر دقتِ کلمات، بررسی میکند که آیا هوش مصنوعی میتواند مثل یک انسانِ واقعی گفتگو کند یا خیر؟ مواردی مثل سرعت پاسخدهی، قطع کردن جملات، رعایت لهجه و حفظ احساسات در این تستها به صورت دقیق سنجیده میشوند تا فاصله مدلهای امروزی با مکالمات انسانی مشخص شود.
این قدم بزرگی برای داشتن دستیارهای صوتی است که واقعاً حس «انسانی» به ما منتقل کنند! 🤖✨
منبع: arXiv AI
