درک طنز در میمها، کاریکاتورها و کمیکها برای هوش مصنوعی همیشه یک چالش بزرگ بوده است، چون شوخیها فراتر از معنای لغوی هستند و به درک فرهنگی و قصد گوینده نیاز دارند. یک مطالعه جدید به بررسی توانایی مدلهای زبانی-تصویری (MLLM) در درک و تولید طنز پرداخته است.
این تحقیق نشان میدهد که با وجود پیشرفتها، هوش مصنوعی هنوز در تشخیص لایههای عمیق طنز، استدلال مبتنی بر شواهد و مسائل مربوط به ایمنی با موانعی روبروست. این مقاله نقشه راهی برای آینده مدلهای چندوجهی در دنیای شوخطبعی ارائه میدهد که بسیار خواندنی است. 🤖🎭
منبع: arXiv AI
