Agent Skills
返回列表
腾讯云语音合成 TTS

腾讯云语音合成 TTS

设计多媒体 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @tencent-adm/tencentcloud-tts。

技能介绍

解决的问题

当脚本、CI 任务或内容生成流程需要把一段文本变成可播放音频时,通常要处理腾讯云 TTS 的认证、请求参数、音频编码和输出文件命名。手动拼接 API 调用容易把 SecretId 或 SecretKey 写死在代码里,也容易遗漏 voice_type、codec 等参数。TencentCloud TTS 技能包把这类基础单次合成流程收敛为可直接调用的参数化能力:输入文本,得到 MP3 或 WAV 文件。

工作方式与关键参数

该技能面向“一次调用合成一段音频”的场景。核心输入包括 text,即要合成的文本内容;voice_type 用于选择语音类型,资料给出范围为 101001 到 101015,默认 101001;codec 控制输出编码,支持 mp3 与 wav;output_file 指定生成的音频文件名,默认 output.mp3。

使用前需要准备腾讯云账号、开通语音合成服务,并获取 API 密钥。密钥建议通过环境变量注入,而不是硬编码。这样在本地调试、服务器运行或集成到工具链时,都能保持同一套调用方式,同时降低密钥泄露风险。

适用边界与注意

它适合对已有文本做单次、批量脚本化合成的工程场景,例如生成提示音、语音播报片段、自动化测试资源或内容预览音频。由于定位为“基础单次合成需求”,不应把它理解成实时流式合成、长文档连续拼接或复杂音频后期处理。实际使用时要注意:单次文本建议不超过 300 字符;避免高频调用触发服务限制;生成文件应按项目目录管理并定期清理;若出现错误,可对照腾讯云 TTS 文档和 API 错误码排查。

使用场景

  • 在 CI 流水线中把固定短提示语合成为 MP3 文件,供自动化测试读取和回放。
  • 编写脚本批量生成语音片段时,将 300 字符以内的文本转为 WAV 并指定输出文件名。
  • 在内容预览工具里将用户输入短句转换为音频文件,使用默认语音类型或指定 101001-101015。
  • 调试播报功能时,通过环境变量注入腾讯云密钥,调用技能生成单条 MP3 音频进行验证。

适合人员

  • 负责 CI 音频样本生成的自动化测试工程师
  • 在内容生成工具中接入短文本语音播报的前端或后端工程师
  • 需要把脚本输出文本批量转为 MP3/WAV 的脚本工程师
  • 要验证腾讯云 TTS 的 voice_type、codec 和输出文件行为的语音应用工程师