免费零门槛的中文配音(微软 edge-tts),按文本生成语音 mp3,无需 API Key、无需注册、国内直连。当用户说"配音""念文案""文本转语音""TTS""朗读""读出来""读一下""念一下""按文本说话""给这段文字配个音""口播配音"时触发。支持晓晓/云希/云扬/小蓓(东北话)等中文音色,可调语速音调。
--- name: edge-tts-dubbing description: 免费零门槛的中文配音(微软 edge-tts),按文本生成语音 mp3,无需 API Key、无需注册、国内直连。当用户说"配音""念文案""文本转语音""TTS""朗读""读出来""读一下""念一下""按文本说话""给这段文字配个音""口播配音"时触发。支持晓晓/云希/云扬/小蓓(东北话)等中文音色,可调语速音调。 agent_created: true --- # 中文配音(edge-tts · 免费零门槛) 把一段文本转成语音 mp3。底层是微软 Edge 的在线 TTS 接口,**免费、零注册、零 Key、国内直连、不限次数**。适合给视频口播、带货文案、教程旁白配"AI 音色"的日常需求。 > ⚠️ 注意:edge-tts 只能用**微软预设音色**,**不能克隆你自己的声音**。 > 要"用强哥自己的声线念文案",走的是声线克隆(GPT-SoVITS / 云端 Fish Audio),那是另一条路。 ## 两个关键坑(必读) 1. **必须清代理**:`scripts/tts.py` 开头已经 `os.environ.pop()` 清掉代理,直接用它即可,别绕过。 否则 WorkBuddy 系统代理会干扰 WebSocket,报 `NoAudioReceived`。 2. **接口间歇性限流**:微软接口偶尔"这次没通",脚本内置**自动重试(5 次 × 2s)**, 大部分 NoAudioReceived 能自动扛过去。若重试到底仍失败,稍后再跑一次。 ## 用法 ```bash # 一句话配音(默认云希男声) "python" \ "edge-tts-dubbing/scripts/tts.py" \ --text "大家好,我是院长,今天聊聊 AI 工具怎么帮你省时间。" \ --voice 云希 --output C:/path/to/out.mp3 # 从口播稿文件读(UTF-8 txt/md) ... --file 口播稿.txt --voice 晓晓 --rate +10% --output 配音.mp3 # 看全部中文音色 ... --list-voices ``` 参数:`--voice`(中文名)、`--rate`(语速)、`--pitch`(音调)、`--output`(输出 mp3 绝对路径)。 **负值参数必须用 `=` 连接**:`--rate=-20%`、`--pitch=-10Hz`(否则 argparse 会把 `-` 当选项报错)。 ## 中文音色表(微软真实存在的,已用 list-voices 核对) | 中文名 | 音色 ID | 定位 | |---|---|---| | 晓晓 | zh-CN-XiaoxiaoNeural | 女 · 温柔自然(通用首选女声,**中老年带货推荐**)| | 云希 | zh-CN-YunxiNeural | 男 · 阳光活力(通用首选男声)| | 云扬 | zh-CN-YunyangNeural | 男 · 专业新闻播报 | | 云健 | zh-CN-YunjianNeural | 男 · 激情有力(带货喊话感)| | 云夏 | zh-CN-YunxiaNeural | 男 · 可爱萌系 | | 晓伊 | zh-CN-XiaoyiNeural | 女 · 活泼俏皮 | | 小蓓 | zh-CN-liaoning-XiaobeiNeural | 东北话 · 女 · 幽默亲切 | | 小妮 | zh-CN-shaanxi-XiaoniNeural | 陕西话 · 女 · 明亮爽朗 | | 晓佳/晓曼/云龙 | zh-HK-HiuGaaiNeural 等 | 粤语(女/女/男)| | 晓臻/晓雨/云哲 | zh-TW-HsiaoChenNeural 等 | 台普(女/女/男)| > 注:网上流传的"晓睿(老年女声)"`zh-CN-XiaoruiNeural` **不存在**,微软中文没有老年专用音色。 ## 依赖 - Python:托管 venv `python` - 包:`edge-tts`(已装 v7.2.8) ## 输出规范 - 默认 mp3,24kHz 单声道 48kbps - 输出路径用绝对路径(视频项目建议放 `video-studio/` 或素材目录) - 长文案建议分段合成再拼接,避免单段过长