🎧 تحولی در تولید صوت با هوش مصنوعی: معرفی AudioX-Turbo! محققان چارچوب جدیدی معرفی کردهاند که میتواند متن، ویدیو یا صوت را با سرعتی باورنکردنی به صداهای باکیفیت تبدیل کند. بزرگترین دستاورد این مدل، کاهش ۲۵ برابری مراحل محاسباتی (NFE) است؛ یعنی تولید موسیقی یا صدا در تنها ۴ مرحله! این مدل با استفاده از یک مجموعه داده عظیم ۹.۲ میلیون تایی آموزش دیده و در تبدیل متن به موسیقی و صوت، عملکرد فوقالعادهای دارد. سرعت بالا در کنار کیفیت عالی، خبر از آیندهای هیجانانگیز برای تولیدکنندگان محتوای صوتی میدهد. 🚀🎶
منبع: arXiv Computer Vision
