دانشمندان در پژوهشی جدید، معماری نوآورانهای به نام «SFGA» را معرفی کردهاند که فرآیند خرید دادههای لازم برای تنظیم دقیق مدلهای زبانی (SFT) را متحول میکند.
این سیستم به جای تصمیمگیریهای کورکورانه، از یک «دروازه آماری» استفاده میکند تا دادهها را بر اساس سه محور اصلی یعنی تنوع، کاربرد و میزان تکراری بودن تحلیل کند. اگر سیستم نسبت به کیفیت داده مطمئن نباشد، آن را به یک «بحث قضاوتگرانه» بین دو وکیل (موافق و مخالف خرید) میسپارد که به شکلی شبیه به مناظره، تصمیم نهایی را میگیرند!
این روش نه تنها دقت بالایی در انتخاب دادههای باکیفیت دارد، بلکه از نظر اقتصادی نیز بسیار بهصرفهتر از روشهای سنتی است. این یعنی کاهش هزینههای گزاف برای توسعهدهندگان در عین افزایش هوشمندی فرآیند آموزش مدلها. 💡
منبع: arXiv AI
