محققان در مقاله جدیدی به بررسی چالش بزرگ «مقیاسپذیری هوش مصنوعی» پرداختهاند. با افزایش تقاضا برای مدلهای قدرتمند، ما با کمبود دادههای باکیفیت مواجه هستیم. این پژوهش با معرفی چارچوب جدیدی به نام «Compute-Data (CD)»، رابطه بین توان پردازشی و دادهها را بازتعریف کرده است.
این مطالعه نشان میدهد که استفاده از روشهایی مثل تکرار دادهها (Multi-epoch) یا بازنویسی آنها، تا کجا میتواند جایگزین دادههای تازه شود. این یافتهها به توسعهدهندگان کمک میکند تا در دنیای کمبود داده، مدلهای بهینهتری بسازند و بودجههای سنگین پردازشی را هوشمندانهتر خرج کنند. 🧠🚀
منبع: arXiv AI
