دادههای آموزشی با کیفیت پایین، پاشنه آشیل مدلهای زبانی بزرگ هستند. محققان به تازگی چارچوب جدیدی به نام «RE-AD» را معرفی کردهاند که به جای تکیه صرف بر نیروی انسانی، از خودِ هوش مصنوعی برای نظارت و اعتبارسنجی فرآیند برچسبگذاری دادهها استفاده میکند.
این سیستم با تجزیه دستورالعملهای استاندارد (SOP) به قوانین سادهتر، به صورت آنی به برچسبزنها بازخورد میدهد که نتیجه آن بهبود ۸۲ درصدی اصلاح خطاها در محیطهای عملیاتی بوده است. این یعنی مسیرِ رسیدن به مدلهای دقیقتر، کوتاهتر از همیشه شده است! 🤖💡
منبع: arXiv AI
