语音互答
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_8c3c5215/voice-chat-echo
技能介绍
问题与定位
语音互答 解决的是 AI 回复仍以文字为主的问题:代码审查、技术讲解、日常对话时,工程师需要持续盯屏,眼睛和注意力负担较高。它不改变 Agent 的核心推理流程,而是在文字输出完成后附加一次语音播报,让回复可以边听边看,甚至闭眼听。
工作方式
- 自动播报:除
NO_REPLY、纯工具调用、系统内部消息外,回复完成后调用 Agent 内置tts工具。 - 文本优化:去掉
Markdown标记;代码不逐行念,改为一句话概括功能;表格转成自然语言;链接只念文字。 - 开场白:首次实质回复前可播报用户配置的称呼和开场白;非主会话不触发。
- 失败降级:第一次失败可重试一次,第二次失败退回纯文字并提示,不反复占用资源。
适用边界
该技能依赖 Agent 平台内置 tts 和音频输出能力,不适用于纯文本终端。当前版本不做实时打断、语音输入或声音克隆;用户说“文字就行”或“别念了”后应停止播报。
使用场景
- 代码审查时,让智能体概括代码逻辑并朗读结论,边听边看改动。
- 学习新技术概念时,让智能体把区别讲成短段落并播报,像听播客。
- 远程会议后整理方案时,让智能体输出要点并朗读,方便闭眼确认。
- 长文档总结时,让智能体保留关键结论并播报,避免逐字阅读。
适合人员
- 负责代码 Review 的前端工程师,希望少盯屏、快速听取逻辑结论。
- 学习前端新概念的自学开发者,想把讲解转成可听的短段落。
- 整理远程会议方案的架构师,想听完要点再确认细节。
- 经常处理长文档摘要的技术支持工程师,想避免逐字阅读。