本次任务主要介绍使用命令行和python两种方式更换paddlespeech tts服务的音色

一、在paddlespeech中更换音色是通过更换声学模型(Acoustic Model)和声码器(Vocoder)实现的。

【PaddleSpeech】TTS 男声音色_副本 - 飞桨AI Studio星河社区

paddlespeech tts --am fastspeech2_aishell3 --voc hifigan_aishell3 --input "你好,欢迎使用百度 飞桨深度学习框架!" --spk_id 167 --output output_zh.wav

比如,在这个命令行中使用了--am参数指定声学模型,--voc参数指定声码器,然后--spk_id参数指定说话人的ID,该参数的取值范围为(±282)

二、选择需要的声学模型和声码器

PaddleSpeech/demos/text_to_speech/README_cn.md at develop · PaddlePaddle/PaddleSpeech  

根据你的需求选择相应语言和性别的声学模型和声码器,直接修改参数值即可自动加载模型启动。

其他模型下载:

PaddleSpeech/examples/csmsc/voc1 at develop · PaddlePaddle/PaddleSpeech

三、服务端修改配置文件指定声学模型和声码器

paddlespeech_server start --config_file ./conf/tts_online_application.yaml

服务端启动还可以通过修改配置文件指定声学模型和声码器

PaddleSpeech/demos/streaming_tts_server/README_cn.md at develop · PaddlePaddle/PaddleSpeech

总结:

虽然开头说介绍两种方法,但是实际只介绍了命令行的方式更换音色。因为python方式在第一个链接里有介绍且跟命令行方式一样更换声学模型和声码器的相关参数值即可,所以为了简洁只介绍了命令行的方式。还有不足的是,我不确定可否使用其他声学模型和声码器在命令行中指定参数进行使用,感兴趣的朋友可以尝试一下。

Logo

中国智能体开发者社区,聚焦智能体与大模型开发,提供前沿资讯、实用工具链、开源项目及行业案例。通过技术沙龙、开发者大赛等活动,促进经验交流与协作,助力开发者快速构建创新智能应用。

更多推荐