腾讯云混元生图
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @tencent-adm/tencentcloud-aiart-texttoimage。
技能介绍
解决什么问题
当 Agent 需要根据用户文本稳定产出 AI 图像时,直接调用云端图像 API 会涉及任务提交、轮询状态、结果 URL 提取等流程。TencentCloud Aiart TextToImage 把腾讯云混元生图包装成可执行脚本,适合把“文本描述生成图片”作为工具调用,而不是让模型口头描述画面。
如何工作
- 默认入口:使用
main.py提交任务并自动轮询,返回生成结果。用户未指定模式时优先采用该脚本。 - 分步控制:
submit_job.py只提交任务并返回JobId;query_job.py根据JobId查询或轮询状态,适合异步流程。 - 关键参数:
--images传入最多 3 张参考图 URL,支持jpg/jpeg/png/webp,base64 后不超过 10MB;--resolution控制宽高,范围 512~2048 像素,且面积不超过 1024×1024;--seed固定随机种子;--revise控制 Prompt 改写,默认开启,会增加约 20s。 - 运行依赖:需要配置腾讯云 API 密钥,脚本可自动安装 Python 依赖;凭证应来自环境变量,不要硬编码。
注意
生成图 URL 有效期为 1 小时,需要及时保存;开启 Prompt 改写会拉长耗时。调用失败时应返回明确错误,不要自行编造图片 URL 或描述生成结果。
使用场景
- 将一段角色设定文本生成 1:1 参考图,供概念设计讨论
- 用 2 张垫图约束商品主图风格,再生成 1024:768 横版候选
- 按 JobId 查询异步生图任务,把可用图片 URL 转存到资产库
- 固定 seed 重跑同一 prompt,记录垫图或改写对成图的影响
适合人员
- 需要把产品文案快速变成视觉草图的产品经理
- 希望用垫图约束风格、生成候选海报的运营设计师
- 需要在自动化流程中提交生图任务并轮询结果的工程师
- 希望固定 seed 和分辨率来对比模型效果的算法测试者