Agent Skills
返回列表
腾讯云混元文生视频

腾讯云混元文生视频

设计多媒体 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_0d760f1d/hunyuan-text-to-video。

技能介绍

要解决的问题

hunyuan-text-to-video 解决的是从文字描述直接生成 MP4 视频的调用问题。工程师不需要先做文生图、再拼接镜头或视频合成,而是把 prompt 交给腾讯云混元生视频 API,由 HunyuanVideo 1.5 模型完成端到端文本到视频生成。适合快速验证创意、生成示例片段,或为 Agent 工作流接入一个可展示的视频结果节点。

技能如何工作

技能通过腾讯云 SubmitHunyuanToVideoJob 提交任务,并用 DescribeHunyuanToVideoJob 查询状态。核心参数包括:

  • --prompt:必填,最多 200 个 UTF-8 字符,超长会被截断。
  • --filename:可选,指定输出文件名,默认按时间戳生成 .mp4。
  • --video-resolution:目前仅支持 720p。
  • --logo-add:控制是否添加水印,0 不添加,1 添加。
  • --secret-id / --secret-key:也可使用 TENCENT_SECRET_ID 与 TENCENT_SECRET_KEY 环境变量传入。

运行时,技能会调用 tencentcloud-sdk-python-vclm 初始化 VclmClient,提交纯 T2V 任务,并等待状态从 WAIT、RUN 变为 DONE。完成后,视频保存为 MP4 到当前工作目录,并打印 VIDEO_READY:/path/to/file.mp4。推荐流程是直接读取该路径展示结果,而不是尝试解析视频内容。

适用边界与注意点

该技能依赖腾讯云账号凭据,使用前需要开通混元生视频服务并具备可用额度或后付费能力。ResultVideoUrl 的有效期为 24 小时,不适合把远端 URL 当作长期资源。默认并发为 1 个任务,上一个任务未完成前不宜连续提交。生成结果受 prompt 长度、720p 分辨率限制,且默认可能添加水印;如果交付给最终用户,需要显式传入 --logo-add 0。

使用场景

  • 在创意评审前,把一句镜头描述快速生成 720p MP4 示例片段,供团队查看效果。
  • 接入 Agent 工作流时,提交文本任务并轮询状态,拿到 VIDEO_READY 路径后展示视频。
  • 需要交付无水印演示视频时,配置凭据和 --logo-add 0,生成 200 字内 prompt 的 MP4。
  • 验证腾讯云混元视频 API 时,用短 prompt 提交纯 T2V 任务,确认 720p 与单并发流程。

适合人员

  • 需要把文字描述转成演示视频的工程师,想接入腾讯云混元文生视频 API 并拿到 MP4 路径。
  • 构建 Agent 展示能力的开发者,想在任务完成后直接展示视频结果而不解析文件内容。
  • 评估视频生成模型的算法工程师,想用 200 字内 prompt 测试 720p 纯文生视频流程。
  • 负责素材预生产的创作者,想快速生成无水印示例片段供评审。