诗云 API GPT-image-2 图片生成与编辑
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_cfdd25ec/gpt-image-2-shiyunapi。
技能介绍
解决什么问题
通过 ShiyunApi 调用 gpt-image-2 时,常见难点不只是发请求:要判断该走 /v1/images/generations 还是 /v1/images/edits,要处理 model 与 modal 字段差异、url / b64_json 等多种响应,还要避免 API Key 写进命令、日志或 memory。这个技能把任务分流、参数校验、脚本执行和结果落盘封装起来。
技能如何工作
- 先判断任务:无图片且要求生成新图,运行
scripts/generate_image.py;有图片、参考图、mask 或“改这张图”,运行scripts/edit_image.py。 - 支持内容:中英文提示词生成海报、头像、封面、插画、产品图、角色设定图等;也支持单图/多图编辑、换背景、保留主体、局部重绘和合成。
- 执行链路:提取
prompt,编辑时提取image/images;优先读取SHIYUN_API_KEY,用户给 Key 时用scripts/save_api_key.py --api-key-stdin经 stdin 保存。 - 参数与输出:默认
model为gpt-image-2,常用size有1024x1024、1536x1024、1024x1536、auto;脚本会保存url、b64_json、base64或未知response.json,并写metadata.json。 - 排障规则:401/403 查 Key,400/422 查
prompt、size、quality、mask,413 查图片大小,未知响应先保存原始 JSON 再总结。
适用边界
适合在线生成和编辑 png、jpg、jpeg、webp 图片;不支持视频生成、图生视频、本地离线修图、截图、压缩、裁剪,也不默认替代其他供应商。mask 透明区域表示要编辑的位置,通常小于 4MB 且尺寸与第一张图一致。
使用场景
- 电商运营在上新前,需要用产品卖点提示词快速生成多张主图背景素材。
- 设计师拿到纯白底商品图,需要提取主体并替换为特定场景背景以用于落地页。
- 独立开发者整合多张 UI 截图或参考图,通过多图合成生成完整的应用概念演示图。
- 内容编辑处理带水印或瑕疵的旧海报,使用遮罩图对局部进行重绘和修补。
适合人员
- 需要快速产出海报、插画和角色设定图,并将多张参考图合成新图的视觉设计师。
- 负责电商详情页和商品主图制作,需要频繁替换商品背景或进行局部修补的运营。
- 开发独立应用,需要调用 API 脚本快速生成应用商店封面图和 UI 概念演示图的产品经理或开发者。
- 制作自媒体视频封面或图文内容,需要基于旧图进行风格调整和主体保留的内容创作者。