تا به حال دقت کردید که مدلهای هوش مصنوعی گاهی در تحلیل احساسات (مثل تن صدا یا حالات چهره) دچار اشتباه یا توهم میشوند؟ محققان بهتازگی فریمورک جدیدی به نام «OPPO» معرفی کردهاند که به مدلهای چندوجهی کمک میکند تا خیلی دقیقتر و واقعیتر، احساسات انسان را از طریق ترکیب متن، تصویر و صدا درک کنند.
این روش با بهینهسازی سیاستهای یادگیری تقویتی، باعث میشود مدلها کمتر دچار خطای «توهم مودالیته» شوند و دقیقاً همان سرنخهای احساسی را تحلیل کنند که در واقعیت وجود دارد. نتیجه این کار؟ سیستمی که به درکِ واقعاً انسانی از احساسات نزدیکتر است! ✨
منبع: arXiv AI
