محققان در مطالعهای جدید، فریمورک «AEGIS» را برای بهبود کنترلپذیری در فرآیند «سمزدایی» (Detoxification) متون معرفی کردهاند.
این مدل با استفاده از راهنماهای سطح واژگان (Span-level)، کمک میکند تا خروجی مدلهای هوش مصنوعی در زبانهای مختلف از جمله انگلیسی، چینی و کرهای، ضمن حفظ معنا، از محتوای نامناسب پاکسازی شود. نکته جالب اینجاست که نتایج این تحقیق نشان میدهد تاثیر این روش کاملاً به مدل پایه و بافت زبانی بستگی دارد و تعادلی دقیق میان حفظ مفهوم و حذف سمیت ایجاد میکند. گامی مهم در مسیر مدلهای هوش مصنوعیِ امنتر و اخلاقیتر! 🧠✨
منبع: arXiv NLP
