تا به حال به فکر هزینه و پیچیدگی آموزش مدلهای زبانی (LLM) بودهاید؟ محققان بهتازگی فریمورک جدیدی به نام «PlanE» را معرفی کردهاند که فرآیند «استخراج داده»، «آموزش دستورالعملها» (Instruction Tuning) و «استنتاج» را بهینهسازی میکند.
ویژگی کلیدی این طرح، استفاده از یک برنامهریز هوشمند (DTI Planner) است که بهترین مدل پایه و تنظیمات لازم را برای هر دیتاسِت خاص انتخاب میکند تا با کمترین هزینه، بهترین نتیجه حاصل شود. این یعنی کارایی بیشتر در ساخت مدلهای تخصصی!
اگر در حوزه توسعه مدلها فعال هستید، میتوانید کدهای این پروژه را در گیتهاب بررسی کنید.
نویسی
منبع: arXiv AI
