GPT图像2 Pro
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_e942ebfc/gpt-image2-pro。
技能介绍
命令行图像生成:从需求到实现
在快速迭代的设计和开发流程中,团队常需要在命令行中直接生成高质量图像,用于原型验证、营销素材或内容创作。传统方法依赖图形界面或复杂 API 调用,难以集成到自动化脚本或批量处理流程中。GPT-image2 技能通过封装 OpenAI 的 gpt-image-2 模型,解决了这一痛点,允许开发者用简短命令生成图片,并精细控制输出参数。
核心能力与工作流程
该技能主要提供两种模式:
- 文生图:输入文本提示词,从零生成图像。例如,执行
python3 imagegen.py "一只宇航猫在月球漫步"即可获得 PNG 格式图片。 - 图生图:上传参考图并添加提示词,基于原图进行编辑。使用
--image参数指定本地图片路径,例如--image cat.jpg,并可通过--fidelity high控制保真度(high保留细节,low允许风格迁移)。
关键步骤包括:
- 配置 API Key:通过环境变量、命令行参数或配置文件设置
REDFOX_API_KEY(从 redfox.hk 获取)。 - 调用生成:使用命令行参数控制尺寸(
--size 1024x1792)、格式(--format webp)、背景透明度(--bg transparent)等。批量生成时,-n 10可单次生成最多 10 张图。 - 任务管理:支持
--no-download仅提交任务,并用--task-id查询状态,适合异步工作流。
适用边界与注意事项
- 尺寸限制:仅支持预设分辨率(如
1024x1024、2048x2048),自定义分辨率可能导致生成失败或延迟。输出格式中,JPEG 不支持透明背景。 - 性能与成本:生成时间通常 10-30 秒,高清档(如
2048x2048)更慢。API 调用可能产生费用,需自行管理额度。 - 文件处理:参考图仅支持 PNG、JPEG、WebP 本地文件;输出默认保存在
~/Downloads/QoderImages,可通过-o修改目录。 - 模型特性:
gpt-image-2为 OpenAI 最新模型,提示词限 500 字,超长文本会被阻断。生成质量受提示词详细程度影响。
通过这些特性,该技能为开发者提供了灵活、可集成的命令行图像生成方案,尤其适合需要自动化或参数化控制的场景。
使用场景
- 设计师在准备社交媒体营销素材时,需要为同一主题快速生成多种尺寸(如正方形、竖版、横版)的图片,用于适配不同平台发布。
- 前端开发工程师在构建网页原型时,需要通过脚本批量生成一组带有透明背景的图标和装饰元素,并直接集成到项目资源目录。
- 数字内容创作者在制作在线课程时,需要基于一段文字描述生成高质量插图,并确保输出为 WebP 格式以优化网页加载速度。
- 产品经理在演示产品功能时,需要将手绘草图或现有截图,通过图生图模式添加细节或修改风格,快速制作出高保真度原型图。
适合人员
- 需要频繁生成不同规格社交媒体配图的运营专员,希望用命令行脚本自动化重复的图片制作任务。
- 负责项目界面资源管理的前端工程师,需要批量创建和更新图标、背景等图片资源,并精确控制格式和尺寸。
- 独立游戏开发者或插画师,需要快速生成概念图或素材草稿,并通过调整保真度参数进行风格探索。
- 技术文档或在线教育内容编纂者,需要为文章批量生成配套插图,并支持透明背景以便于排版合成。