تا به حال دقت کردید که دستیارهای صوتی چقدر در نوبتگیری برای حرف زدن ضعیف هستند؟ محققان در پژوهش جدیدی، بنچمارک جالبی به نام «Instruct-FD» معرفی کردهاند تا بفهمند آیا مدلهای «فولدوبلکس» (Full-Duplex) میتوانند طبق دستورات ما، سبکِ نوبتگیری خود را تغییر دهند یا نه؟
نتایج این تحقیق نشان میدهد که حتی پیشرفتهترین سیستمهای فعلی هم در این زمینه لنگ میزنند و تنها حدود ۶۴ درصد در رعایت این دستورات موفق بودهاند! این یعنی هنوز راه زیادی داریم تا سیستمهایی داشته باشیم که مثل یک مشاور یا معلم هوشمند، دقیقاً بداند چه زمانی باید سکوت کند، چه زمانی پاسخ دهد و چه زمانی حرفمان را قطع نکند.
این تحقیق گام مهمی برای ساخت دستیارهای صوتی است که در دنیای واقعی، طبیعیتر و منعطفتر رفتار میکنند. 🧠✨
منبع: arXiv AI
