OpenRouter 图像生成与编辑
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @org-02qudk26/generate-image。
技能介绍
适用问题
generate-image 面向需要快速产出照片级图片、艺术插画、演示视觉素材的任务,而不是流程图、电路图或科学示意图。它把 prompt、可选输入图像和模型选择封装到一次脚本调用中,避免手工处理 OpenRouter 请求、Base64 解码与文件落盘。
工作方式
核心是运行 scripts/generate_image.py:
- 必填:
prompt描述生成内容或编辑指令。 - 编辑:通过
--input传入 PNG、JPEG、GIF 或 WebP 图片。 - 模型:默认
google/gemini-3.1-flash-image-preview,也可选black-forest-labs/flux.2-pro;black-forest-labs/flux.2-flex仅适合低成本生成。 - 输出:默认写入
generated_image.png,可用--output指定路径。 - 密钥:读取
.env中的OPENROUTER_API_KEY,也可用--api-key临时覆盖。
脚本会报告 API 错误、响应格式异常和依赖缺失,并把返回的 Base64 数据 URL 保存为 PNG。生成时间通常受模型和队列影响,编辑输入会被编码后发送给模型。
使用边界
生成与编辑效果依赖提示词的具体程度:编辑现有图像时,应写明“把天空改成日落色”这类明确变更,而不是只说“编辑天空”。复杂科研图表应转给 scientific-schematics;需要幻灯片或海报时,可将本技能产出的图片作为视觉素材组合使用。
使用场景
- 为产品发布会准备一组主视觉插画,把提示词交给脚本并指定 PNG 输出路径。
- 把现有封面照片的天空改成日落色,用 --input 传入图片并写明具体编辑指令。
- 给内部技术文档生成概念艺术配图,使用默认 Gemini 3.1 Flash Image Preview 模型。
- 批量产出演示幻灯片所需的写实图片,多次运行脚本并用不同 prompt 和输出路径。
适合人员
- 做产品视觉的运营:每周要为发布会、社媒推文和官网活动产出封面图与主视觉插画。
- 写技术文档的工程编辑:需要为文档章节补充概念图、通用配图和可编辑的视觉素材。
- 做客户汇报的咨询顾问:要把抽象业务流程和方案概念转成清晰插画,并修改现有图片。
- 独立开发者:需要在 README、演示视频或产品页面中快速生成写实图片并编辑已有图像。