Agent Skills
返回列表
ADP 多模态生成

ADP 多模态生成

设计多媒体 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_33aa5c8b/search-baidusearch-baidusearch-baidusearch-baidusearch-baidusearch-baidusearch-baidusearch-baidusearch-baidusearch-baidu 到你的 AI 助手。

技能介绍

解决的问题

在中文业务里,用户会直接提出“生图、生视频、生成 3D 模型”等请求,但底层可能对应多个能力模块和模型版本。若调用方直接传底层标识或随意降级,容易出现参数不匹配、平台限制被误判、跨模态偷偷替换等问题。这个 Skill 的目标是把中文意图收敛到已核实的 ADP 多模态能力上,并以异步任务方式稳定执行。

工作方式

核心能力覆盖三类模块:image.hy、image.gi 用于图片生成;video.kling、video.vidu 用于视频生成;3d.hy 用于 3D 模型生成。技能按路由规则选择默认能力,例如图片默认 image.hy,提到 Gemini、nano banana 或要求换模型时切到 image.gi;视频默认 video.kling,提到 VIDU 或要求切换时切到 video.vidu;3D 固定 3d.hy。执行时只接受模块别名,不接受底层标识。
流程分四步:先按用户意图选择能力;再按能力选择 text2image、image2image、text2video、image2video、text23d、image23d 模式;然后按异步 submit/query 成对执行任务;最后汇报最终能力、命中原因、失败阶段和平台限制。需要 ADP_API_KEY,依赖为 requests。

适用边界

该 Skill 面向 ADP 平台多模态能力,不是腾讯云开放 API。只有 references/ability-catalog.md 中已核实字段可当作事实。若目标能力不能执行,应直接汇报阻塞,不跨模态降级、不猜测内部接口、不私自换模型。

使用场景

  • 在中文营销页需求中,将产品描述转成多张候选图片,并用 `image.hy` 或 `image.gi` 异步生成与查询结果。
  • 把静态首帧图做成短视频,根据用户提到 VIDU 或可灵,路由到 `video.kling` 或 `video.vidu` 执行 `image2video`。
  • 需要交付 3D 概念模型时,调用 `3d.hy` 的 `text23d` 或 `image23d`,按异步任务提交并轮询结果。
  • 在多模态能力联调中,只使用已核实的模块别名,失败时判断是 `submit` 失败还是 `query` 结果失败。

适合人员

  • 负责中文多模态内容生成的后端工程师:希望按用户意图路由到 ADP 的图片、视频、3D 模块并统一查询结果。
  • 接入 ADP 平台的智能体应用开发者:需要在不硬编码底层模型 ID 的情况下,调用已核实的 `image`、`video`、`3d` 能力。
  • 做多模态能力联调的平台工程师:希望明确 `submit` 与 `query` 失败阶段,并避免跨模态静默降级。
  • 面向中文业务的 AI 产品工程师:需要根据 Gemini、nano banana、VIDU 等关键词切换对应生成模型。