آیا تا به حال دقت کردهاید که مدلهای زبانی گاهی جملاتی مثل «این فقط یک دوره آموزشی نیست، بلکه یک سفر برای دگرگونی است» را تکرار میکنند؟ محققان در یک پژوهش جدید، این پدیده را «اپانورتوزیس» (Epanorthosis) یا همان تمایل مدلها به خوداصلاحیِ نمایشی نامیدهاند.
بررسیها نشان میدهد که این رفتار، نتیجه آموزشهای بازخورد انسانی (RLHF) و متون تبلیغاتی است که مدل را به سمت استفاده از لحنهای تأکیدی و مبالغهآمیز سوق میدهد. خبر خوب این است که محققان روشهای جدیدی مثل استفاده از LoRA یا حتی یک خط دستورالعمل ساده برای اصلاح این رفتار و طبیعیتر کردن خروجی مدلها پیدا کردهاند.
این مقاله نشان میدهد که چطور میتوانیم مدلها را به سبک نگارش انسانی نزدیکتر کنیم و از تکرارهای خستهکننده آنها بکاهیم.
منبع: arXiv AI
