محققان در پژوهشی جدید، مدل نوآورانهای به نام «GRASP» را برای درک بهتر کنایه (Sarcasm) در محتواهای چندرسانهای معرفی کردهاند. این مدل با استفاده از «استدلال زنجیرهای» (Chain-of-Thought) و ترکیب آن با «زمینهسازی بصری» (Visual Grounding)، نه تنها متن کنایهآمیز را تشخیص میدهد، بلکه دقیقاً مشخص میکند که کدام بخش از تصویر یا متن باعث ایجاد این کنایه شده است.
این مدل با استفاده از یک مجموعه داده جدید به نام MSTI-MAX و روشهای بهینهسازی پیشرفته، عملکرد بسیار دقیقتری نسبت به روشهای سنتی در تشخیص کنایههای پیچیده دارد. این یک گام بزرگ برای تعامل هوشمندتر ماشین با احساسات و ظرافتهای انسانی است! 🧠✨
منبع: arXiv NLP
