Kling TTS 情感语音合成
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_f95f21b8/dlazy-keling-tts。
技能介绍
解决的问题
当 Agent 需要把提示词、字幕或文案转换成可播放语音时,直接调用云厂商 SDK 会引入密钥配置、异步任务轮询和错误处理等细节。keling tts 把这些收敛成一条 dlazy keling-tts 命令:输入文本与参数,输出 Kling TTS 的语音结果或任务状态,适合在本地工作流里接入情感语音生成。
工作方式
该技能是 dLazy 托管 API 的薄客户端。调用时,文本和参数发送到 api.dlazy.com 进行推理;若传入本地文件路径,CLI 会将其上传到 dLazy 媒体存储,供模型读取;生成后的资源通常以 files.dlazy.com 上的 URL 返回。
- 认证:通过 dLazy API key 访问,也可用
DLAZY_API_KEY临时提供。 - 同步输出:默认等待任务完成并返回语音结果。
- 异步模式:使用
--no-wait时返回task.generateId与status,再查询任务状态。 - 参数引用:支持
-、@N、@N.path、@stdin等管道引用,方便串联上游输出。 - 错误提示:
401表示 key 缺失或无效,503可能提示余额不足或服务异常。
适用边界
它适合把短文本、脚本或生成式文案转换为 Kling TTS 语音,不适合需要完全离线推理、私有化部署或绕过 dLazy 账户计费的场景。若结果返回 insufficient_balance 或 unauthorized,需要按提示检查 dLazy 账户额度或 API key。
使用场景
- 制作短视频配音时,把已审定的旁白脚本转成带情感的语音,再取回音频 URL 用于混音。
- 在播客流程中,用 `--no-wait` 提交单集要点稿的语音任务,并轮询状态直到音频可用。
- 制作课件时,把 Markdown 分段文案逐段生成语音,便于编辑试听并挑选最佳朗读。
- 串联 Agent 输出时,用 `@N.path` 读取文案字段,并直接送入 Kling TTS 生成语音。
适合人员
- 负责短视频配音的后期制作,需要把脚本快速转成可试听的情感语音。
- 搭建 Agent 工作流的工程师,希望把上游文案字段直接接入语音生成命令。
- 制作播客或课件的编辑,需要把多段文字生成语音并逐条试听筛选。
- 使用 dLazy API 的产品团队,需要用 CLI 统一处理 TTS 调用和余额提示。