Edge-TTS 怎么用?免费语音合成接口实操

🤖 本文由 AI 辅助生成,编辑团队审核发布 · 内容仅供参考,纠错反馈
AI教程 2026-10-01
0

能解决什么问题?

你是否遇到过这些情况:想给视频配音但不想花钱买语音合成服务;需要批量把文章转成音频,但各大平台都限制字数或收费;想用 Python 做个有声书工具,却找不到稳定免费的接口。Edge-TTS 就是答案——它调用的是微软 Edge 浏览器内置的语音合成引擎,完全免费、无需注册、国内可直接连接,支持多种语言和音色,还能调节语速、音量。对个人开发者、自媒体创作者、学生党来说,是性价比极高的语音合成方案。

准备工作(注册/入口)

使用 Edge-TTS 不需要注册任何账号,也不需要 API Key。你只需要准备:

  • 一台电脑:Windows、macOS、Linux 均可。
  • Python 环境:推荐 Python 3.8 及以上版本。如果没装,去 Python 官网下载安装包,安装时勾选“Add Python to PATH”。
  • 网络连接:国内网络可直接访问,无需特殊设置。
  • 命令行工具:Windows 用 PowerShell 或 CMD,macOS/Linux 用终端。

入口就是 Python 的包管理工具 pip,一条命令即可安装 Edge-TTS。

分步骤实操

步骤 1:安装 Edge-TTS

打开命令行,输入以下命令并回车:

pip install edge-tts

如果下载慢,可以加上国内镜像源,例如:

pip install edge-tts -i https://pypi.tuna.tsinghua.edu.cn/simple

安装成功后,命令行输入 edge-tts --help 能看到帮助信息,说明安装完成。

步骤 2:查看可用音色

Edge-TTS 内置了很多音色,中文普通话有多个男声和女声。输入以下命令列出所有中文音色:

edge-tts --list-voices | findstr zh-CN

Windows 用 findstr,macOS/Linux 用 grep。你会看到类似 zh-CN-XiaoxiaoNeural(女声)、zh-CN-YunxiNeural(男声)等名称。记下你想用的音色名。

步骤 3:生成第一个语音文件

在命令行输入:

edge-tts --voice zh-CN-XiaoxiaoNeural --text "你好,欢迎使用 Edge-TTS 语音合成。" --write-media hello.mp3

回车后,当前目录下会生成 hello.mp3。用播放器打开,就能听到清晰的中文语音。如果想调整语速,可以加上 --rate=+20%(加快 20%)或 --rate=-10%(减慢 10%)。

步骤 4:用 Python 脚本批量合成

命令行适合单次转换,批量处理建议写 Python 脚本。新建一个文件 tts.py,输入以下代码:

import edge_tts
import asyncio

async def main():
text = "这是第一段。这是第二段。"
voice = "zh-CN-XiaoxiaoNeural"
communicate = edge_tts.Communicate(text, voice)
await communicate.save("output.mp3")

asyncio.run(main())

保存后运行 python tts.py,就会生成 output.mp3。如果要批量处理多个文本,可以把文本放在列表里循环调用。

步骤 5:从文件读取文本并生成

如果文本很长,可以保存为 input.txt,然后运行:

edge-tts --voice zh-CN-YunxiNeural --file input.txt --write-media long.mp3

这样就能把整个文本文件转成语音,适合制作有声书或长文章音频。

进阶技巧

技巧命令/方法说明
调整语速--rate=+30%正数加快,负数减慢,范围建议 -50% 到 +100%
调整音量--volume=+20%正数增大,负数减小
调整音调--pitch=+10Hz改变音调高低,适合角色配音
输出字幕--write-subtitles output.vtt生成与语音同步的字幕文件
批量转换Python 循环 + asyncio用脚本遍历文本列表,自动生成多个音频
选择其他语言--voice en-US-AriaNeural支持英语、日语、韩语等,用 --list-voices 查看

常见问题

问:Edge-TTS 需要付费或注册吗?

答:完全免费,无需注册,也不需要 API Key。它调用的是微软 Edge 浏览器的在线语音合成服务,国内网络可直接使用。但请注意不要滥用,避免高频请求导致 IP 被临时限制。

问:生成的音频可以商用吗?

答:Edge-TTS 使用的是微软的语音合成技术,生成的音频版权归微软所有。个人学习和非商业用途一般没问题,但商业用途建议查看微软官方条款,或考虑购买正规商业授权。用于自媒体配音时,建议先小范围测试。

问:为什么运行命令后没有生成文件?

答:先检查命令行是否在正确的目录下,再确认文本中是否包含特殊字符(如引号),必要时用文件方式传入文本。如果报错“Connection refused”,可能是网络波动,稍后重试或检查防火墙设置。另外,确保 Python 和 edge-tts 都是最新版本。

用AI上智库 · 每日精选 AI 工具与实战教程
收藏 AI智库,每天 3 分钟掌握最新 AI 动态;5000+ 人在用的工具库持续更新。
逛逛工具库 →
©️版权声明:若无特殊声明,本站所有文章版权均归AI智库原创和所有,未经许可,任何个人、媒体、网站、团体不得转载、抄袭或以其他方式复制发表本站内容,或在非我站所属的服务器上建立镜像。否则,我站将依法保留追究相关法律责任的权利。

相关文章

发表评论