能解决什么问题?
你是否遇到过这些情况:想给视频配音但不想花钱买语音合成服务;需要批量把文章转成音频,但各大平台都限制字数或收费;想用 Python 做个有声书工具,却找不到稳定免费的接口。Edge-TTS 就是答案——它调用的是微软 Edge 浏览器内置的语音合成引擎,完全免费、无需注册、国内可直接连接,支持多种语言和音色,还能调节语速、音量。对个人开发者、自媒体创作者、学生党来说,是性价比极高的语音合成方案。
准备工作(注册/入口)
使用 Edge-TTS 不需要注册任何账号,也不需要 API Key。你只需要准备:
- 一台电脑:Windows、macOS、Linux 均可。
- Python 环境:推荐 Python 3.8 及以上版本。如果没装,去 Python 官网下载安装包,安装时勾选“Add Python to PATH”。
- 网络连接:国内网络可直接访问,无需特殊设置。
- 命令行工具:Windows 用 PowerShell 或 CMD,macOS/Linux 用终端。
入口就是 Python 的包管理工具 pip,一条命令即可安装 Edge-TTS。
分步骤实操
步骤 1:安装 Edge-TTS
打开命令行,输入以下命令并回车:
pip install edge-tts
如果下载慢,可以加上国内镜像源,例如:
pip install edge-tts -i https://pypi.tuna.tsinghua.edu.cn/simple
安装成功后,命令行输入 edge-tts --help 能看到帮助信息,说明安装完成。
步骤 2:查看可用音色
Edge-TTS 内置了很多音色,中文普通话有多个男声和女声。输入以下命令列出所有中文音色:
edge-tts --list-voices | findstr zh-CN
Windows 用 findstr,macOS/Linux 用 grep。你会看到类似 zh-CN-XiaoxiaoNeural(女声)、zh-CN-YunxiNeural(男声)等名称。记下你想用的音色名。
步骤 3:生成第一个语音文件
在命令行输入:
edge-tts --voice zh-CN-XiaoxiaoNeural --text "你好,欢迎使用 Edge-TTS 语音合成。" --write-media hello.mp3
回车后,当前目录下会生成 hello.mp3。用播放器打开,就能听到清晰的中文语音。如果想调整语速,可以加上 --rate=+20%(加快 20%)或 --rate=-10%(减慢 10%)。
步骤 4:用 Python 脚本批量合成
命令行适合单次转换,批量处理建议写 Python 脚本。新建一个文件 tts.py,输入以下代码:
import edge_tts
import asyncio
async def main():
text = "这是第一段。这是第二段。"
voice = "zh-CN-XiaoxiaoNeural"
communicate = edge_tts.Communicate(text, voice)
await communicate.save("output.mp3")
asyncio.run(main())
保存后运行 python tts.py,就会生成 output.mp3。如果要批量处理多个文本,可以把文本放在列表里循环调用。
步骤 5:从文件读取文本并生成
如果文本很长,可以保存为 input.txt,然后运行:
edge-tts --voice zh-CN-YunxiNeural --file input.txt --write-media long.mp3
这样就能把整个文本文件转成语音,适合制作有声书或长文章音频。
进阶技巧
| 技巧 | 命令/方法 | 说明 |
|---|---|---|
| 调整语速 | --rate=+30% | 正数加快,负数减慢,范围建议 -50% 到 +100% |
| 调整音量 | --volume=+20% | 正数增大,负数减小 |
| 调整音调 | --pitch=+10Hz | 改变音调高低,适合角色配音 |
| 输出字幕 | --write-subtitles output.vtt | 生成与语音同步的字幕文件 |
| 批量转换 | Python 循环 + asyncio | 用脚本遍历文本列表,自动生成多个音频 |
| 选择其他语言 | --voice en-US-AriaNeural | 支持英语、日语、韩语等,用 --list-voices 查看 |
常见问题
问:Edge-TTS 需要付费或注册吗?
答:完全免费,无需注册,也不需要 API Key。它调用的是微软 Edge 浏览器的在线语音合成服务,国内网络可直接使用。但请注意不要滥用,避免高频请求导致 IP 被临时限制。
问:生成的音频可以商用吗?
答:Edge-TTS 使用的是微软的语音合成技术,生成的音频版权归微软所有。个人学习和非商业用途一般没问题,但商业用途建议查看微软官方条款,或考虑购买正规商业授权。用于自媒体配音时,建议先小范围测试。
问:为什么运行命令后没有生成文件?
答:先检查命令行是否在正确的目录下,再确认文本中是否包含特殊字符(如引号),必要时用文件方式传入文本。如果报错“Connection refused”,可能是网络波动,稍后重试或检查防火墙设置。另外,确保 Python 和 edge-tts 都是最新版本。
智库妙影 AI数字人
智库创课 AI课件
智库GEO AI搜索优化
智库妙鉴 AI命理文化
Agent社区 智能体交流
智影新媒体OS 新媒体创作
辽公网安备21021102001760号