یکی از داغترین مباحث این روزهای دنیای AI، توانایی مدلهای زبانی (LLM) برای تقلید از سبک نوشتاری شخصی (Style Personalization) است. اما سوال اصلی اینجاست: چطور بفهمیم خروجی مدل واقعاً شبیه سبک ماست؟
محققان در مطالعه جدید خود، معیارهای فعلی مثل BLEU یا حتی داوری توسط خودِ مدلهای هوش مصنوعی را به چالش کشیدند. نتایج نشان میدهد که این روشها اغلب دچار خطاهای جدی هستند و دقت کافی ندارند.
این مقاله پیشنهاد میدهد که برای رسیدن به یک “شخصیسازی واقعی” در متن، باید از ترکیبی از معیارهای متنوع استفاده کرد تا دقت ارزیابی بالا برود. خبر خوبی برای توسعهدهندگان است تا بتوانند مدلهایی بسازند که لحن و استایل نویسنده را با وفاداری بیشتری حفظ کنند. ✍️🤖
منبع: arXiv NLP
