语音生成报告
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_543d2acf/baogaozc。
技能介绍
解决的问题
在办公场景中,很多“主题速览”任务需要人工完成三步:搜集资料、整理成报告、再转成可播放音频。该技能面向这类流程,把主题输入、报告生成、语音合成和上传交付压缩成一条可执行链路,减少手动搬运内容的操作。
工作方式
- 报告生成:根据主题检索客观信息,按“先客观事实、后主观评价”的结构生成不少于 500 字 的纯文本报告;主观评价要求覆盖现状分析、原因判断、未来趋势和个人观点。
- 语音合成:将文本按 100–120 字自然断句拆分,优先调用
Edge TTS托管 API;当接口超时或失败时,回退到node-edge-tts,并使用Xiaoxiao Neural逐段生成 MP3。 - 交付处理:通过
ffmpeg合并音频文件,调用upload.py完成上传,最后返回 HTTP 协议音频链接,供用户直接播放。
适用边界
该技能适合对外分享、快速播报、语音摘要等场景,但输出格式固定为单段纯文本报告和 HTTP MP3 链接。若要求 HTTPS 链接、内网存储、可编辑文档格式,或需要多轮事实核查,应在交付前人工复核。
使用场景
- 为行业简报把指定主题写成五百字以上说明,并生成MP3播放链接。
- 给培训材料补充一段主题解读,输出纯文字报告与中文语音播报。
- 把临时选题变成可分发的语音摘要,供同事直接点击HTTP链接收听。
- 制作客户简报口播稿,生成单段纯文本并合成晓晓中文语音。
适合人员
- 需要把临时主题快速转成可播报简报的内容编辑
- 要把培训资料整理成语音摘要的运营专员
- 制作客户简报并交付MP3链接的市场专员
- 负责语音内容分发并校验播放链接的产品运营