محققان در پژوهشی جدید، مدلهای زبانی چندوجهی (MLLM) را برای «تشخیص احساسات» (MER) وارد فاز تازهای کردهاند. مدل جدید EmoAgent-R1 با استفاده از یادگیری تقویتی (Reinforcement Learning) یاد میگیرد که چگونه با تخصیص پویای «عاملها» (Agents)، احساسات پیچیده در ویدیوها و متنها را تحلیل کند.
ویژگی اصلی این مدل استفاده از استراتژی جدید P-GRPO است که دقت تشخیص و استدلال را در سیستمهای هوشمند به شدت افزایش میدهد. این یعنی هوش مصنوعی حالا بهتر از همیشه میتواند لایههای ظریف احساسی در ورودیهای چندرسانهای را درک کند! 🚀✨
منبع: arXiv AI
