محققان در یک پژوهش جدید، سیستم هوشمند پیشرفتهای را توسعه دادهاند که میتواند «تردید» و «دودلی» انسانها را هنگام صحبت کردن تشخیص دهد. این مدل با ترکیب ویژگیهای صوتی و تحلیلهای متنی (بدون نیاز به ویدیو)، میتواند سیگنالهای پنهان در گفتار را شناسایی کند.
ویژگیهای کلیدی این سیستم:
✅ استفاده از مدل زبانی RoBERTa برای درک احساسات
✅ تحلیل ویژگیهای صوتی برای تشخیص لحن
✅ تمرکز ویژه بر مولفههایی مثل تردید و تضاد در کلام
این فناوری میتواند در آینده کاربردهای زیادی در دستیارهای صوتی هوشمند و سیستمهای تحلیل روانشناختی داشته باشد. کدهای این پروژه هم به صورت متنباز منتشر شده تا پژوهشگران بتوانند آن را توسعه دهند.
منبع: arXiv Computer Vision
