میمها به دلیل ماهیت بصری و کنایهآمیزشان، همیشه چالش بزرگی برای سیستمهای نظارتی بودهاند. حالا محققان چارچوب جدیدی به نام «SAFE-MEME» معرفی کردهاند که با استفاده از استدلال ساختاریافته (Structured Reasoning)، دقت شناسایی محتوای نفرتآمیز در میمها را به شدت افزایش میدهد.
این مدل با دو متد مختلف (پرسش و پاسخ زنجیرهای و دستهبندی سلسلهمراتبی) توانسته است حتی از مدلهای متنباز فعلی پیشی بگیرد و عملکردی نزدیک به غولهایی مثل GPT-4o داشته باشد. این یک گام مهم برای ایجاد فضای سالمتر در شبکههای اجتماعی است. 🚀
منبع: arXiv NLP
