Edge 在线语音合成
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_c9d52b8e/edge-tts-mf。
技能介绍
要解决的问题
本地脚本或 CI 任务常需要把文本快速变成可播放的 MP3,但不想申请语音 API Key,也不想维护付费语音服务。Edge TTS 利用微软 Edge 在线语音合成,提供一条无 Key 的免费文本转语音路径,适合自动化播报、语音素材预览和轻量媒体生成场景。
如何工作
技能提供两个核心脚本:
scripts/tts_edge.py:调用edge-tts将文字合成为MP3。scripts/tts_play.py:使用pyglet对MP3做无头播放。
常用参数包括 --voice 指定语音、--rate 调整语速、--pitch 调整音调、--volume 调整音量、--output 指定输出路径,以及 --play 在合成后自动播放。默认中文语音是 zh-CN-XiaoxiaoNeural,也可使用 zh-CN-YunxiNeural、zh-CN-YunyangNeural 等风格差异更明显的音色。--list 可列出可选语音,完整列表见 references/voices.md。
适用边界
它适合轻量、免费、中文优先的 TTS 任务,尤其是需要快速拿到 MP3 文件或触发播放的本地工作流。由于依赖 Edge 在线服务,输出稳定性、音色可用性可能受网络与上游策略影响;不适合高并发、SLA 敏感或必须离线运行的生产环境。
使用场景
- 自动化任务里把通知文本合成为 MP3 并指定输出路径。
- 测试多段中文播报时切换不同音色并调整语速、音调。
- 在无浏览器环境生成 MP3 后用 pyglet 直接触发播放。
- 维护语音脚本时列出可用中文音色并选择新闻或可爱风格。
适合人员
- 需要把脚本日志或播报文本转成 MP3 的自动化工程师
- 测试中文语音风格并调整语速、音调的语音产品工程师
- 在没有图形界面服务上生成并触发音频播放的后端工程师
- 维护 TTS 配置、需要查询可用中文音色的集成工程师