腾讯推出AI音乐模型LeVo,媲美Suno 4.5,支持零样本音色克隆

6.17 腾讯AI实验室6月17日正式发布全新AI音乐生成模型LeVo,该模型在多项关键指标上媲美行业领先的Suno4.5,并具备零样本音色克隆能力,仅需3秒音频即可精准复刻目标音色,为音乐创作带来革命性突破

20250617214859
Aiyxl/Jimeng AI


腾讯AI实验室6月17日正式发布全新AI音乐生成模型LeVo,该模型在多项关键指标上媲美行业领先的Suno 4.5,并具备零样本音色克隆能力,仅需3秒音频即可精准复刻目标音色,为音乐创作带来革命性突破。  

 

媲美Suno 4.5,LeVo展现硬核实力  

LeVo采用语言模型(LM)架构,结合LeLM和音乐编解码器,可并行生成混合音轨(人声+伴奏)或分轨音轨(人声与伴奏分离),在音乐性、音质、人声与伴奏和谐度等维度超越现有开源学术模型。评测显示,LeVo在歌词对齐能力(LYC)上比Suno 4.5高出0.21分,展现出更强的文本控制能力。  

 

零样本音色克隆:3秒复刻任意声音  

LeVo的零样本音色克隆(Zero-Shot Voice Cloning)功能仅需3秒音频片段,即可精准模仿目标音色,包括音调、情感和韵律,无需大量训练数据。这一技术可应用于个性化音乐创作、歌手音色模仿等场景,极大降低专业音乐制作门槛。  

 

分轨生成:专业音乐制作的利器  

与传统AI音乐模型不同,LeVo支持双轨生成模式,可分别输出人声和伴奏,为后期混音提供更大灵活性。相比之下,Suno 4.5在分轨支持上稍显不足,LeVo的这一特性为行业树立了新标杆。  

 

高保真音质与开源承诺  

LeVo在音质表现上接近Suno 4.5的行业标准,尤其在音乐性、人声与伴奏和谐度等方面表现出色。腾讯还宣布,LeVo将以开源形式发布,提供完整代码和预训练模型,推动全球AI音乐生态发展。  

 

行业影响与未来展望  

LeVo的推出标志着中国AI音乐技术迈入全球前沿,其零样本音色克隆和分轨生成功能为音乐创作带来全新可能。尽管在歌曲结构清晰度上略逊于Suno 4.5,但LeVo凭借高性价比和开源优势,有望成为AI音乐领域的强有力竞争者。  


20250618080515

 

腾讯表示,LeVo未来将优化生成效果,并探索更多商业化应用场景,助力音乐产业智能化升级。


项目地址:https://levo-demo.github.io/