Agent Skills
返回列表
腾讯云混元生图

腾讯云混元生图

设计多媒体 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @tencent-adm/tencentcloud-aiart-texttoimage。

技能介绍

解决什么问题

当 Agent 需要根据用户文本稳定产出 AI 图像时,直接调用云端图像 API 会涉及任务提交、轮询状态、结果 URL 提取等流程。TencentCloud Aiart TextToImage 把腾讯云混元生图包装成可执行脚本,适合把“文本描述生成图片”作为工具调用,而不是让模型口头描述画面。

如何工作

  • 默认入口:使用 main.py 提交任务并自动轮询,返回生成结果。用户未指定模式时优先采用该脚本。
  • 分步控制:submit_job.py 只提交任务并返回 JobId;query_job.py 根据 JobId 查询或轮询状态,适合异步流程。
  • 关键参数:--images 传入最多 3 张参考图 URL,支持 jpg/jpeg/png/webp,base64 后不超过 10MB;--resolution 控制宽高,范围 512~2048 像素,且面积不超过 1024×1024;--seed 固定随机种子;--revise 控制 Prompt 改写,默认开启,会增加约 20s。
  • 运行依赖:需要配置腾讯云 API 密钥,脚本可自动安装 Python 依赖;凭证应来自环境变量,不要硬编码。

注意

生成图 URL 有效期为 1 小时,需要及时保存;开启 Prompt 改写会拉长耗时。调用失败时应返回明确错误,不要自行编造图片 URL 或描述生成结果。

使用场景

  • 将一段角色设定文本生成 1:1 参考图,供概念设计讨论
  • 用 2 张垫图约束商品主图风格,再生成 1024:768 横版候选
  • 按 JobId 查询异步生图任务,把可用图片 URL 转存到资产库
  • 固定 seed 重跑同一 prompt,记录垫图或改写对成图的影响

适合人员

  • 需要把产品文案快速变成视觉草图的产品经理
  • 希望用垫图约束风格、生成候选海报的运营设计师
  • 需要在自动化流程中提交生图任务并轮询结果的工程师
  • 希望固定 seed 和分辨率来对比模型效果的算法测试者