Agent Skills
返回列表
GPT Image2 高质量 AI 生图

GPT Image2 高质量 AI 生图

设计多媒体 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_ef6dcdec/gpt-image2。

技能介绍

解决什么问题

gpt-image-2 单次出图约 150 秒,直接同步请求会撞上常见 60s 超时;同时批量生成、参考图、海报文字渲染都需要稳定的参数与状态轮询。该技能把异步提交、结果查询、登录凭证和限流封装成一组命令行工具,让 Agent 能在不自行维护 job_id 与等待逻辑的情况下完成生图。

核心工作流

  • 提交任务:调用 gpt-image2.gpt_image2_submit,传入 prompt、size、n、style 和 reference_image_urls,返回 job_id。
  • 轮询结果:调用 gpt-image2.gpt_image2_result,服务端已 sleep 50 秒,客户端使用 --timeout 70 留余量,直到状态为 done 或 error。
  • 风格控制:内置 20 个 style preset,覆盖吉卜力、Pixar、粘土、乐高、赛博朋克、博物铜版画等;参考图 URL 可用于图生图和换风格保人物。

适用边界

  • 每次提交都会消耗真实积分,批量 n > 1 或多轮重试应视为多次扣费。
  • 生成内容会经由网关发送,prompt 与参考图 URL 不应包含机密或个人敏感信息。
  • 若任务超过 600 秒仍在运行,应保留 job_id 继续查询,而不是立即判定失败。

使用场景

  • 市场运营要把产品卖点做成竖版海报,并让中文标题准确出现在画面中。
  • 视觉设计需要把参考图里的角色换成吉卜力或 Pixar 风格,同时保留脸部和品牌元素。
  • 技术内容编辑要把复杂流程做成科普爆炸图,并将步骤文字按提示词写进图片。
  • Agent 工程师需要封装异步生图流程,用 submit 获取 job_id 并轮询 result 拿图片 URL。

适合人员

  • 需要把营销文案变成带文字海报的运营或市场人员。
  • 需要基于参考图保持人物或品牌并切换画风的视觉设计师。
  • 需要调用异步生图任务并处理 job 状态的 Agent 工程师。
  • 需要制作科普信息图或结构爆炸图的技术内容编辑。