ADP 多模态生成
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_33aa5c8b/search-baidusearch-baidusearch-baidusearch-baidusearch-baidusearch-baidusearch-baidusearch-baidusearch-baidusearch-baidu 到你的 AI 助手。
技能介绍
解决的问题
在中文业务里,用户会直接提出“生图、生视频、生成 3D 模型”等请求,但底层可能对应多个能力模块和模型版本。若调用方直接传底层标识或随意降级,容易出现参数不匹配、平台限制被误判、跨模态偷偷替换等问题。这个 Skill 的目标是把中文意图收敛到已核实的 ADP 多模态能力上,并以异步任务方式稳定执行。
工作方式
核心能力覆盖三类模块:image.hy、image.gi 用于图片生成;video.kling、video.vidu 用于视频生成;3d.hy 用于 3D 模型生成。技能按路由规则选择默认能力,例如图片默认 image.hy,提到 Gemini、nano banana 或要求换模型时切到 image.gi;视频默认 video.kling,提到 VIDU 或要求切换时切到 video.vidu;3D 固定 3d.hy。执行时只接受模块别名,不接受底层标识。
流程分四步:先按用户意图选择能力;再按能力选择 text2image、image2image、text2video、image2video、text23d、image23d 模式;然后按异步 submit/query 成对执行任务;最后汇报最终能力、命中原因、失败阶段和平台限制。需要 ADP_API_KEY,依赖为 requests。
适用边界
该 Skill 面向 ADP 平台多模态能力,不是腾讯云开放 API。只有 references/ability-catalog.md 中已核实字段可当作事实。若目标能力不能执行,应直接汇报阻塞,不跨模态降级、不猜测内部接口、不私自换模型。
使用场景
- 在中文营销页需求中,将产品描述转成多张候选图片,并用 `image.hy` 或 `image.gi` 异步生成与查询结果。
- 把静态首帧图做成短视频,根据用户提到 VIDU 或可灵,路由到 `video.kling` 或 `video.vidu` 执行 `image2video`。
- 需要交付 3D 概念模型时,调用 `3d.hy` 的 `text23d` 或 `image23d`,按异步任务提交并轮询结果。
- 在多模态能力联调中,只使用已核实的模块别名,失败时判断是 `submit` 失败还是 `query` 结果失败。
适合人员
- 负责中文多模态内容生成的后端工程师:希望按用户意图路由到 ADP 的图片、视频、3D 模块并统一查询结果。
- 接入 ADP 平台的智能体应用开发者:需要在不硬编码底层模型 ID 的情况下,调用已核实的 `image`、`video`、`3d` 能力。
- 做多模态能力联调的平台工程师:希望明确 `submit` 与 `query` 失败阶段,并避免跨模态静默降级。
- 面向中文业务的 AI 产品工程师:需要根据 Gemini、nano banana、VIDU 等关键词切换对应生成模型。