Agent Skills
返回列表
GPT图像2 Pro

GPT图像2 Pro

设计多媒体 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_e942ebfc/gpt-image2-pro。

技能介绍

命令行图像生成:从需求到实现

在快速迭代的设计和开发流程中,团队常需要在命令行中直接生成高质量图像,用于原型验证、营销素材或内容创作。传统方法依赖图形界面或复杂 API 调用,难以集成到自动化脚本或批量处理流程中。GPT-image2 技能通过封装 OpenAI 的 gpt-image-2 模型,解决了这一痛点,允许开发者用简短命令生成图片,并精细控制输出参数。

核心能力与工作流程

该技能主要提供两种模式:

  • 文生图:输入文本提示词,从零生成图像。例如,执行 python3 imagegen.py "一只宇航猫在月球漫步" 即可获得 PNG 格式图片。
  • 图生图:上传参考图并添加提示词,基于原图进行编辑。使用 --image 参数指定本地图片路径,例如 --image cat.jpg,并可通过 --fidelity high 控制保真度(high 保留细节,low 允许风格迁移)。

关键步骤包括:

  1. 配置 API Key:通过环境变量、命令行参数或配置文件设置 REDFOX_API_KEY(从 redfox.hk 获取)。
  2. 调用生成:使用命令行参数控制尺寸(--size 1024x1792)、格式(--format webp)、背景透明度(--bg transparent)等。批量生成时,-n 10 可单次生成最多 10 张图。
  3. 任务管理:支持 --no-download 仅提交任务,并用 --task-id 查询状态,适合异步工作流。

适用边界与注意事项

  • 尺寸限制:仅支持预设分辨率(如 1024x10242048x2048),自定义分辨率可能导致生成失败或延迟。输出格式中,JPEG 不支持透明背景。
  • 性能与成本:生成时间通常 10-30 秒,高清档(如 2048x2048)更慢。API 调用可能产生费用,需自行管理额度。
  • 文件处理:参考图仅支持 PNG、JPEG、WebP 本地文件;输出默认保存在 ~/Downloads/QoderImages,可通过 -o 修改目录。
  • 模型特性gpt-image-2 为 OpenAI 最新模型,提示词限 500 字,超长文本会被阻断。生成质量受提示词详细程度影响。

通过这些特性,该技能为开发者提供了灵活、可集成的命令行图像生成方案,尤其适合需要自动化或参数化控制的场景。

使用场景

  • 设计师在准备社交媒体营销素材时,需要为同一主题快速生成多种尺寸(如正方形、竖版、横版)的图片,用于适配不同平台发布。
  • 前端开发工程师在构建网页原型时,需要通过脚本批量生成一组带有透明背景的图标和装饰元素,并直接集成到项目资源目录。
  • 数字内容创作者在制作在线课程时,需要基于一段文字描述生成高质量插图,并确保输出为 WebP 格式以优化网页加载速度。
  • 产品经理在演示产品功能时,需要将手绘草图或现有截图,通过图生图模式添加细节或修改风格,快速制作出高保真度原型图。

适合人员

  • 需要频繁生成不同规格社交媒体配图的运营专员,希望用命令行脚本自动化重复的图片制作任务。
  • 负责项目界面资源管理的前端工程师,需要批量创建和更新图标、背景等图片资源,并精确控制格式和尺寸。
  • 独立游戏开发者或插画师,需要快速生成概念图或素材草稿,并通过调整保真度参数进行风格探索。
  • 技术文档或在线教育内容编纂者,需要为文章批量生成配套插图,并支持透明背景以便于排版合成。