میمهای اینترنتی ترکیبی از تصویر، متن و فرهنگ هستند که تفسیر آنها برای مدلهای هوش مصنوعی همیشه یک چالش بزرگ بوده است. محققان به تازگی چارچوب جدیدی به نام MAR-12 را معرفی کردهاند که به جای نگاه سطحی، با بررسی ۱۲ دیدگاه ساختاریافته (برگرفته از تئوریهای طنز و نفرت)، میتواند میمهای توهینآمیز یا سمی را با دقت بسیار بالا شناسایی و دلیل این تشخیص را به صورت شفاف توضیح دهد.
این مدل که بر پایه مدلهای بینایی-زبانی (VLM) ساخته شده، گام مهمی در جهت ایمنسازی فضای آنلاین و درک بهتر لایههای پیچیده طنز در شبکههای اجتماعی محسوب میشود.
منبع: arXiv AI
