تا به حال فکر کردهاید که اگر آموزش مدلهای بزرگ هوش مصنوعی بهجای دیتاسنترهای گرانقیمت در اختیار همه باشد چه میشود؟ محققان بهتازگی پروتکل جدیدی به نام «BlockTrain» ارائه دادهاند که مدلهای هوش مصنوعی را به قطعات کوچکتر تقسیم کرده و اجازه میدهد آموزش آنها بهصورت غیرمتمرکز و روی سیستمهای مختلف انجام شود.
این روش نه تنها نیاز به زیرساختهای متمرکز را از بین میبرد، بلکه اجازه میدهد مدلهای حجیم (تا ۷۵ میلیارد پارامتر) روی سیستمهای متصل به شبکه عمومی (TCP) با کارایی بالا اجرا شوند. گامی بزرگ برای دموکراتیزه کردن آموزش هوش مصنوعی برای محققان مستقل! 🌐💡
چین
منبع: arXiv AI
