爱可可-爱生活
23-12-25 05:53 微博认证:AI博主 2025微博新锐新知博主

[AS] StyleSinger: Style Transfer for Out-Of-Domain Singing Voice Synthesis
http://t.cn/A6l0Xl52
提出StyleSinger模型,用于零样本迁移域外参考歌声样本的歌声合成。该模型采用了两个关键方法:1)Residual Style Adaptor (RSA)通过使用残差量化模块捕捉歌声中多样的风格特征;2)Uncertainty Modeling Layer Normalization (UMLN)在训练阶段扰动内容表示中的风格属性,从而提高模型的泛化性能。实验证明,StyleSinger在音频质量和与参考歌声样本的相似度方面优于基线模型。

发布于 北京