تکنولوژی ساخت «کاور آهنگ» (Cover Song Generation) هر روز پیشرفتهتر میشود. محققان به تازگی مدل جدیدی به نام MPEcho معرفی کردهاند که مشکل اصلی مدلهای قبلی در رعایت دقیق متن ترانه و هماهنگی فونتیک را حل میکند.
نکته جذاب اینجاست که این مدل با استفاده از یک ابزار جدید به نام Phonsa (مبتنی بر مدل Whisper)، جزئیات دقیقتری از فونمها و زمانبندی صوتی را استخراج میکند تا نتیجه نهایی کاملاً طبیعی و دقیق باشد. اگر به دنیای هوش مصنوعی در موسیقی علاقه دارید، این ابزار یکی از قدمهای رو به جلو در کاهش خطاهای گفتاری در بازخوانی آهنگهاست.
منبع: arXiv AI
