Agent Skills
返回列表
诗云 API GPT-image-2 图片生成与编辑

诗云 API GPT-image-2 图片生成与编辑

设计多媒体 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_cfdd25ec/gpt-image-2-shiyunapi。

技能介绍

解决什么问题

通过 ShiyunApi 调用 gpt-image-2 时,常见难点不只是发请求:要判断该走 /v1/images/generations 还是 /v1/images/edits,要处理 model 与 modal 字段差异、url / b64_json 等多种响应,还要避免 API Key 写进命令、日志或 memory。这个技能把任务分流、参数校验、脚本执行和结果落盘封装起来。

技能如何工作

  • 先判断任务:无图片且要求生成新图,运行 scripts/generate_image.py;有图片、参考图、mask 或“改这张图”,运行 scripts/edit_image.py。
  • 支持内容:中英文提示词生成海报、头像、封面、插画、产品图、角色设定图等;也支持单图/多图编辑、换背景、保留主体、局部重绘和合成。
  • 执行链路:提取 prompt,编辑时提取 image / images;优先读取 SHIYUN_API_KEY,用户给 Key 时用 scripts/save_api_key.py --api-key-stdin 经 stdin 保存。
  • 参数与输出:默认 model 为 gpt-image-2,常用 size 有 1024x1024、1536x1024、1024x1536、auto;脚本会保存 url、b64_json、base64 或未知 response.json,并写 metadata.json。
  • 排障规则:401/403 查 Key,400/422 查 prompt、size、quality、mask,413 查图片大小,未知响应先保存原始 JSON 再总结。

适用边界

适合在线生成和编辑 png、jpg、jpeg、webp 图片;不支持视频生成、图生视频、本地离线修图、截图、压缩、裁剪,也不默认替代其他供应商。mask 透明区域表示要编辑的位置,通常小于 4MB 且尺寸与第一张图一致。

使用场景

  • 电商运营在上新前,需要用产品卖点提示词快速生成多张主图背景素材。
  • 设计师拿到纯白底商品图,需要提取主体并替换为特定场景背景以用于落地页。
  • 独立开发者整合多张 UI 截图或参考图,通过多图合成生成完整的应用概念演示图。
  • 内容编辑处理带水印或瑕疵的旧海报,使用遮罩图对局部进行重绘和修补。

适合人员

  • 需要快速产出海报、插画和角色设定图,并将多张参考图合成新图的视觉设计师。
  • 负责电商详情页和商品主图制作,需要频繁替换商品背景或进行局部修补的运营。
  • 开发独立应用,需要调用 API 脚本快速生成应用商店封面图和 UI 概念演示图的产品经理或开发者。
  • 制作自媒体视频封面或图文内容,需要基于旧图进行风格调整和主体保留的内容创作者。