GPT-image2 图像生成
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @redfox-data/image-gen-redfox。
技能介绍
解决什么问题
当你想把图像生成从网页交互搬到脚本、流水线或批量任务里时,直接调用 OpenAI gpt-image-2 需要处理 API 鉴权、任务提交、轮询和文件落盘。这个技能把这条链路收敛成一个本地脚本:输入提示词即可生成图片,也可以基于参考图做编辑,适合工程师在终端中做快速原型、素材变体或自动化出图。
核心能力与关键步骤
- 文生图:用
prompt描述画面,输出 PNG、JPEG 或 WebP。 - 图生图:通过
--image传入参考图,并用--fidelity high/low控制保留原图细节还是允许更大改动。 - 参数化输出:支持白名单尺寸、单次最多
10张、--bg transparent生成透明背景、--compression调整压缩比。 - 任务控制:可用
--no-download仅提交不等待,用--task-id查询已有任务,便于把生成动作嵌入更长的工作流。
使用时先配置 API Key,然后执行脚本并传入提示词、尺寸、数量、格式等参数;脚本会完成提交、等待结果并保存到输出目录。
边界与注意点
- 尺寸只建议用资料中列出的快速档和高清档分辨率,自定义分辨率可能导致过慢或失败。
prompt限制在 500 字以内;参考图目前支持 PNG、JPEG、WebP。- 透明背景需要配合 PNG 或 WebP,JPEG 不支持。
- 单次生成通常约 10-30 秒,复杂场景更久,批量任务要考虑等待时间。
使用场景
- 在终端脚本里用提示词批量生成多张产品概念图,并保存到指定输出目录。
- 已有参考图时,用图生图模式做风格迁移或改图,并用保真度控制细节保留。
- 需要透明背景素材时,用 PNG/WebP 格式生成图标、贴纸或 UI 贴图。
- 在自动化流程中仅提交生成任务,之后用任务 ID 查询结果,避免脚本阻塞。
适合人员
- 需要把图像生成写进本地脚本或流水线的前端工程师
- 要批量制作透明背景图标和素材的 UI 设计师
- 希望基于参考图快速生成风格变体的独立开发者
- 需要维护自动化出图任务并跟踪结果的技术运营