Agent Skills
返回列表
知数定流数字人学员版

知数定流数字人学员版

设计多媒体 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_af5300c4/zsdlszr。

技能介绍

问题:数字人 API 流程多且提交约束特殊

数字人视频生成要处理形象、音色、TTS、视频任务和下载。手工调用容易踩坑:POST 不能用 curl,且 video_model_id、text、content 等字段容易混。

工作方式:从资产确认到自动化下载

  • 先用 Authorization: Bearer 验证 GET /api/digital.base_image/list 与 GET /api/digital.CloneVoice/list,创建 我的内容库(勿动)/13数字人作品/... 目录。
  • 文案先编号,不急着 TTS;再选择用户自己的形象和音色。
  • TTS 用 Python 调用 POST /api/digital.v2.Voice/synthesis,文本字段为 text,轮询 GET /api/digital.v2.Voice/result?id={id} 获取 audio_url。
  • 视频提交调用 POST /api/digital.video/create,传 video_model_id、audio_url、version、name、priority,不再传原始文本。
  • 正常队列和闲时队列分别延迟检查,成功后下载 output_video_url,失败记录原因。

适用边界与注意点

  • GET 可用 curl,POST 必须使用 Python,避免 Schannel SSL 兼容问题影响请求体解析。
  • 适合已有 ZSDL Key、管理个人资产和视频任务的用户;不处理公共形象、公共声音、计费或权限审批。
  • 敏感词拦截会标记作品并展示原文,修改后可重新生成配音并提交,其他作品不受影响。

使用场景

  • 在已有 ZSDL API Key 后,验证个人形象与克隆音色资产,并把多段口播文案编号准备生成数字人视频。
  • 把选定文案逐条合成克隆音色配音,轮询 TTS 结果并保存 audio_url,再提交 v5/v6 数字人作品。
  • 根据正常队列或闲时队列创建时间文件夹,提交视频任务后延迟检查状态并自动下载成功视频。
  • 当视频创建返回敏感词拦截时,定位被拦截文案,修改后重新生成配音并重新提交对应作品。

适合人员

  • 已有 ZSDL API Key、需要把个人形象与克隆音色批量转成口播视频的创作者
  • 需要按文案、模型和队列提交数字人视频,并自动下载成品的运营人员
  • 要处理 TTS 与视频创建接口字段、并规避 curl POST 兼容问题的集成工程师
  • 在正常与闲时队列之间安排任务、希望延迟检查后自动归档视频的内容团队