前段时间有群友问我,有什么比较好的TTS吗?
恰好端午节在家闲着无聊,
翻到了一个TTS模型-Confucius4-TTS,1.3B大小,
无需参考文本可以无约束声音克隆,很适合本地部署,
测试了一下之后,效果很不错,尤其是音色、情绪克隆这一块。
比如,把之前给小孩做的唐诗300首的网站,增加其他语言。
http://t.cn/AXaslhQy
其实,我感觉对做出海内容的更有用,因为,你在国内已经有一段口播了,翻译成其他语言,你可以没办法说的很流畅,但是你原视频本身又有明显的情感起伏和你自己的特点,那你直接clone声音,拿何同学的视频举例。
Confucius4-TTS的整体效果我还是挺满意的,
优势很明显,相较于其他开源TTS模型来说, 子曰这个跨语言几乎没有口音,
当然,这个模型也存在一些不足的情况,比如,不支持流式输出,不支持文本情绪设置。
期待后续持续更新。
#how i ai# #开源# #TTS#
发布于 浙江
