通用声音表征方案众多,为什么没有一个能做声音基座?音频数据,是否越多就越好;声音,是否只能被转录成文字;理解与生成,又是否必须分拆成两个模型……本文将分享 Xiaomi Dasheng 系列技术实践中的重要判断,以及预研项目的技术思考。 http://t.cn/AXaU7NLQ
发布于 北京
通用声音表征方案众多,为什么没有一个能做声音基座?音频数据,是否越多就越好;声音,是否只能被转录成文字;理解与生成,又是否必须分拆成两个模型……本文将分享 Xiaomi Dasheng 系列技术实践中的重要判断,以及预研项目的技术思考。 http://t.cn/AXaU7NLQ