※鱼鱼╰☆ 发表于 2022-7-25 18:15

文本批量微软语音

1.安装python,下载https://github.com/skygongque/tts的项目。
2.cmd中安装python库
    pip install requests==2.15.1
    pip install websockets==10.2
3.解压下载文件,在tts-main\python_cli_demo下建立snd和txt两个文件夹。
4.把要转换的文本文件复制到tts-main\python_cli_demo下,注意编码要是ansi,utf-8的我没研究出来,这里我把原来的tts.py编码选项改了下才能用,有兴趣的可以深入研究下。
def get_SSML(path):
    with open(path,'r',encoding='utf-8') as f:
      return f.read()
我试的是把原文件中的,encoding='utf-8'删去才能用。
3.把getxt.py同样复制到tts-main\python_cli_demo下。
    location='G:\\D\\tts-main\\python_cli_demo\\',这里目录改成你的,注意为\\。
    里面默认是晓秋的声音,可在geTxt(input('BOOK:'),2333,3,'zh-CN-XiaoqiuNeural')中改参数。
    各朗读人及效果参见https://www.bilibili.com/video/BV1Ua411p7Xh?spm_id_from=333.999.0.0&vd_source=68f4b4a96c3c24c71d90a9c596506b64
    2333是分割字数,3是生成的xml后缀数字位数,zh-CN-XiaoqiuNeural是朗读人的名字,可修改。
4.在tts-main\python_cli_demo下cmd中执行python getxt.py,输入文本文件名(不含txt)。
    在txt中会生成分割后的xml文件,在tts-main\python_cli_demo会生成start.bat文件,会自已运行。
5.稍等在snd文件夹中就会生成声音了,2333个字符一段,大概8分多钟。
   再次执行上述操作会删除snd和txt文件夹中文件,请生成后及时移走。

演示:
https://www.bilibili.com/video/BV1Va411u7WM/?vd_source=68f4b4a96c3c24c71d90a9c596506b64

下载:
链接: https://pan.baidu.com/s/1Qx3ffRygokO2hurcZhZUJw?pwd=52pj 提取码: 52pj 复制这段内容后打开百度网盘手机App,操作更方便哦



程野 发表于 2022-7-25 18:23

谢谢大佬

拉古拉 发表于 2022-7-25 18:24


感谢楼主的分享

lybukesiyi 发表于 2022-7-25 19:06

谢谢大牛

1041671881 发表于 2022-7-25 19:06

感谢楼主分享

shinan 发表于 2022-7-25 19:14

谢谢大佬分享

笑东风丶 发表于 2022-7-25 19:29

感谢大佬分享,大佬666666

getrss 发表于 2022-7-25 19:31

6666

igdoyxog 发表于 2022-7-25 21:33

谢谢分享!

狼人杀 发表于 2022-7-25 21:44


支持楼主,谢谢分享。
页: [1] 2
查看完整版本: 文本批量微软语音