讯飞听见语音转文字
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,将 @user_294a7000/xftj-transcribe 安装到当前 AI 助手中,使其具备讯飞听见语音转文字能力。
技能介绍
解决什么问题
处理会议录音、访谈或课程音频时,常见难点不只是把语音变成文字,还包括转写任务状态轮询、权益选择与支付、历史结果下载,以及后续纪要整理。这个技能把讯飞听见音频转写封装成统一的 xftj.py CLI,让 Agent 可以用固定步骤完成从上传到获取文本结果的流程,而不是零散调用多个接口。
核心能力与关键步骤
技能基于纯 Python 架构,核心命令包括:
transcribe:完成新音频的上传、启动转写、轮询状态,并返回可用权益列表;list/detail:查询历史转写文件和指定记录详情;download:根据hj_id获取转写文本结果,内部自动查询originAudioId;ai-summary:获取或生成 AI 会议纪要,自动轮询等待结果;validate/auth:检查apiKey是否有效,失效时通过本地 OAuth 回调完成授权。
新文件转写通常分为两步:先上传并启动转写,再由用户选择权益完成支付与下载。批量处理多个音频时,技能会建议分组上传、并行轮询和分批汇总,避免长时间串行等待。
适用边界与注意点
该技能适合中文、英文常见音频格式转写,如 mp3、wav、m4a。转写耗时与音频长度相关,轮询期间不宜中断;每次转写会消耗账户权益,需要先确认账户可用额度。AI 纪要可能需要额外 1-3 分钟生成,超时后可选择继续等待,或基于转写文本生成兜底摘要。配置文件位于 ~/.xftj/config.json,运行前需要确保 API Key 有效。
使用场景
- 处理会议录音时,先校验 API Key,再上传音频并轮询转写状态。
- 收到文件夹内多份访谈音频,分组上传并并行轮询,最后汇总转写结果。
- 已有转写记录 hjId,需要查询历史列表并下载对应的文本结果。
- 转写完成后获取 AI 会议纪要,超时则基于转写文本生成兜底摘要。
适合人员
- 负责客户访谈记录的咨询顾问:需要把多段录音快速转成文本并下载。
- 需要整理会议结论的项目经理:需要获取转写结果和 AI 纪要。
- 维护 Agent 工作流的工程师:需要用 CLI 稳定调用讯飞听见转写接口。
- 做播客或课程整理的编辑:需要批量转写音频并提取纪要。