Agent Skills
返回列表
Edge 在线语音合成

Edge 在线语音合成

设计多媒体 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_c9d52b8e/edge-tts-mf。

技能介绍

要解决的问题

本地脚本或 CI 任务常需要把文本快速变成可播放的 MP3,但不想申请语音 API Key,也不想维护付费语音服务。Edge TTS 利用微软 Edge 在线语音合成,提供一条无 Key 的免费文本转语音路径,适合自动化播报、语音素材预览和轻量媒体生成场景。

如何工作

技能提供两个核心脚本:

  • scripts/tts_edge.py:调用 edge-tts 将文字合成为 MP3。
  • scripts/tts_play.py:使用 pyglet 对 MP3 做无头播放。

常用参数包括 --voice 指定语音、--rate 调整语速、--pitch 调整音调、--volume 调整音量、--output 指定输出路径,以及 --play 在合成后自动播放。默认中文语音是 zh-CN-XiaoxiaoNeural,也可使用 zh-CN-YunxiNeural、zh-CN-YunyangNeural 等风格差异更明显的音色。--list 可列出可选语音,完整列表见 references/voices.md。

适用边界

它适合轻量、免费、中文优先的 TTS 任务,尤其是需要快速拿到 MP3 文件或触发播放的本地工作流。由于依赖 Edge 在线服务,输出稳定性、音色可用性可能受网络与上游策略影响;不适合高并发、SLA 敏感或必须离线运行的生产环境。

使用场景

  • 自动化任务里把通知文本合成为 MP3 并指定输出路径。
  • 测试多段中文播报时切换不同音色并调整语速、音调。
  • 在无浏览器环境生成 MP3 后用 pyglet 直接触发播放。
  • 维护语音脚本时列出可用中文音色并选择新闻或可爱风格。

适合人员

  • 需要把脚本日志或播报文本转成 MP3 的自动化工程师
  • 测试中文语音风格并调整语速、音调的语音产品工程师
  • 在没有图形界面服务上生成并触发音频播放的后端工程师
  • 维护 TTS 配置、需要查询可用中文音色的集成工程师