🚀 هوش مصنوعی و وسواس در خوداصلاحی: چرا مدل‌ها بیش از حد از عبارات اصلاحی استفاده می‌کنند؟ 🧠

🧠 چرا هوش مصنوعی گاهی «خیالات» می‌بیند؟

آیا تا به حال دقت کرده‌اید که مدل‌های زبانی گاهی جملاتی مثل «این فقط یک دوره آموزشی نیست، بلکه یک سفر برای دگرگونی است» را تکرار می‌کنند؟ محققان در یک پژوهش جدید، این پدیده را «اپانورتوزیس» (Epanorthosis) یا همان تمایل مدل‌ها به خوداصلاحیِ نمایشی نامیده‌اند.

بررسی‌ها نشان می‌دهد که این رفتار، نتیجه آموزش‌های بازخورد انسانی (RLHF) و متون تبلیغاتی است که مدل را به سمت استفاده از لحن‌های تأکیدی و مبالغه‌آمیز سوق می‌دهد. خبر خوب این است که محققان روش‌های جدیدی مثل استفاده از LoRA یا حتی یک خط دستورالعمل ساده برای اصلاح این رفتار و طبیعی‌تر کردن خروجی مدل‌ها پیدا کرده‌اند.

این مقاله نشان می‌دهد که چطور می‌توانیم مدل‌ها را به سبک نگارش انسانی نزدیک‌تر کنیم و از تکرارهای خسته‌کننده آن‌ها بکاهیم.

منبع: arXiv AI