🛡️ مبارزه با محتوای سمی در فضای بازی‌ها با مدل RAKSHAK

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

آیا تا به حال به این فکر کردید که چطور می‌توان از رفتارهای سمی و توهین‌آمیز در بازی‌های آنلاین مثل «World of Tanks» جلوگیری کرد؟

محققان در مقاله‌ای جدید، مدل هوشمند «RAKSHAK» را معرفی کرده‌اند که با استفاده از معماری DeBERTa و ترکیب آن با تکنیک‌های پیشرفته‌ای مثل «تقطیر منطق» (Rationale Distillation) از مدل Qwen2.5، توانسته در دسته‌بندی دقیق متون سمی عملکرد بسیار خوبی داشته باشد.

نکته جالب این پژوهش، غلبه بر چالش کمبود داده برای دسته‌های خاص و استفاده از انتقال دانش (Transfer Learning) از داده‌های Jigsaw است. این دستاورد نشان می‌دهد که چطور ترکیب مدل‌های زبانی بزرگ با آموزش‌های چندوظیفه‌ای (Multi-task) می‌تواند فضای بازی‌های آنلاین را برای همه سالم‌تر و امن‌تر کند.

منبع: arXiv NLP