Agent Skills
返回列表
Jimeng OmniHuman 1.5 数字人视频

Jimeng OmniHuman 1.5 数字人视频

设计多媒体 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_f95f21b8/dlazy-jimeng-omnihuman-1-5。

技能介绍

解决的问题

数字人播报视频通常要把人像图片、音频或文本、口型和视频输出串成一条生成流程。这个技能将 Jimeng OmniHuman 1.5 的调用收敛到 dlazy jimeng-omnihuman-1.5 命令,减少手工整理提示词、上传素材和轮询任务状态的碎片操作。它适合需要快速产出数字人播报、虚拟主播视频或素材预览的工程师与内容工作流。

工作方式与适用边界

该技能本质上是 dLazy hosted API 的薄客户端:

  • 输入:人像图片、音频或文本、提示词等参数通过 dlazy CLI 提交到 api.dlazy.com 进行推理。
  • 素材处理:本地文件路径会被上传到 files.dlazy.com,生成结果也返回为托管 URL;这不是纯本地推理。
  • 任务模式:默认等待结果;使用 --no-wait 时返回 task 与异步生成 ID,需要通过状态轮询确认完成。
  • 凭证:请求依赖 dLazy API Key,可通过 CLI 配置或 DLAZY_API_KEY 环境变量提供;401、余额不足、参数缺失、本地文件读取失败等错误需要按返回码处理。

注意:该技能不新增 Jimeng 模型本身的视频能力,主要提供稳定调用、错误提示与异步任务流程。涉及真实人物肖像、商用播报或对外发布时,应遵守平台条款、素材授权和安全策略。

使用场景

  • 电商内容制作:用商品讲解音频和主播头像生成一段口播视频,用于详情页或直播预热。
  • 培训课程制作:把讲师人像和课程旁白音频合成为数字人授课片段,减少真人反复录制。
  • 营销视频测试:批量替换不同提示词与音频,快速产出虚拟主播预告片,比较口型和表达效果。
  • 远程演示准备:在本地准备头像、脚本音频和提示词,通过 CLI 异步提交并轮询结果,生成可分享视频 URL。

适合人员

  • 数字人视频工程师:需要把头像、音频、提示词稳定接入 Jimeng OmniHuman 1.5 并处理异步任务。
  • 电商或内容运营:每周用商品讲解脚本和主播头像生成口播视频,用于投放测试。
  • 培训课程制作人:想把旁白音频和讲师形象快速合成授课片段,减少真人重录。
  • dLazy API 开发者:需要基于 dLazy CLI 与错误码构建数字人生成流水线。