محققان در دستاوردی جدید، روشی نوآورانه برای تولید متنهای فراگیر (Inclusive Language) و پاسخهای ضد-روایت (Counter-Narrative) معرفی کردهاند. این سیستم که با نام IHLC شناخته میشود، از دو تکنیک جذاب استفاده میکند:
۱. استفاده از LoRA برای بازنویسی متنها با رویکرد حفظ حریم جنسیتی.
۲. مهندسیِ «جهتِ هدایت» (Activation Steering) در لایههای مدل Gemma-3، بدون نیاز به تغییر وزنهای مدل! 🧠
این روش به مدلها اجازه میدهد بدون هزینه محاسباتیِ سنگین، خروجیهای مودبانهتر و مناسبتری تولید کنند. یافتههای این پژوهش به ما کمک میکند تا مدلهای زبانی را هوشمندتر، اخلاقیتر و در عین حال بهینهتر کنیم. 🤖⚖️
منبع: arXiv NLP


