dLazy 音频生成
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_f95f21b8/dlazy-audio-generate。
技能介绍
要解决的问题
当提示词里混合了“生成语音”“做背景音乐”“加音效”等需求时,手工选择 dLazy CLI 的音频模型容易出错:TTS、音乐、SFX、声音克隆分别对应不同命令和参数。dlazy-audio-generate 的目标是把这一步交给代理:先判断任务类型,再选择合适模型并执行。
工作方式
它本质上是 dLazy 托管 API 的薄客户端,依赖 @dlazy/cli 和 dLazy API Key。核心流程包括:
- 根据
generate audio、text to speech、generate music、sound effect等触发词解析意图; - 从可用模型中选择:
gemini-2.5-tts、doubao-tts、keling-tts适合 TTS,suno.music适合音乐,keling-sfx适合音效,vidu-audio-clone、kling-audio-clone适合声音克隆; - 通过
dlazy -h检查参数后执行命令,并把 prompt、参数发送到api.dlazy.com; - 如果传入本地文件路径,CLI 会把文件上传到 dLazy 媒体存储,输出 URL 也由
files.dlazy.com托管。
注意点
该技能不替代 dLazy 账户体系。调用前需要有效 API Key;缺少 Key 会返回 unauthorized,额度不足会返回 insufficient_balance。涉及本地路径时要注意文件必须可读;异步任务失败会返回 504 及后端原因。由于生成内容依赖第三方 API 和安全策略,敏感提示词、声音克隆素材和输出分发都应先确认授权与合规。
使用场景
- 给播客脚本生成旁白,让代理自动选择 TTS 模型并输出音频。
- 为短视频补充 BGM,用提示词调用 dLazy 音乐生成并拿到音频 URL。
- 生成游戏 UI 点击音效,避免手工区分 SFX 与 TTS 的命令参数。
- 基于已有参考音频做声音克隆,生成指定角色的短语音片段。
适合人员
- 负责播客后期制作的音频编辑:需要把脚本快速转成可用旁白。
- 做短视频包装的视频创作者:需要按提示词生成 BGM 和音效。
- 开发交互应用的工程师:需要为 UI 状态生成可复用的点击音效。
- 做 AI 原型的产品设计师:需要用参考音频生成角色语音演示。