Agent Skills
返回列表
🎨

OpenRouter 图像生成与编辑

设计多媒体 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @org-02qudk26/generate-image。

技能介绍

适用问题

generate-image 面向需要快速产出照片级图片、艺术插画、演示视觉素材的任务,而不是流程图、电路图或科学示意图。它把 prompt、可选输入图像和模型选择封装到一次脚本调用中,避免手工处理 OpenRouter 请求、Base64 解码与文件落盘。

工作方式

核心是运行 scripts/generate_image.py:

  • 必填:prompt 描述生成内容或编辑指令。
  • 编辑:通过 --input 传入 PNG、JPEG、GIF 或 WebP 图片。
  • 模型:默认 google/gemini-3.1-flash-image-preview,也可选 black-forest-labs/flux.2-pro;black-forest-labs/flux.2-flex 仅适合低成本生成。
  • 输出:默认写入 generated_image.png,可用 --output 指定路径。
  • 密钥:读取 .env 中的 OPENROUTER_API_KEY,也可用 --api-key 临时覆盖。

脚本会报告 API 错误、响应格式异常和依赖缺失,并把返回的 Base64 数据 URL 保存为 PNG。生成时间通常受模型和队列影响,编辑输入会被编码后发送给模型。

使用边界

生成与编辑效果依赖提示词的具体程度:编辑现有图像时,应写明“把天空改成日落色”这类明确变更,而不是只说“编辑天空”。复杂科研图表应转给 scientific-schematics;需要幻灯片或海报时,可将本技能产出的图片作为视觉素材组合使用。

使用场景

  • 为产品发布会准备一组主视觉插画,把提示词交给脚本并指定 PNG 输出路径。
  • 把现有封面照片的天空改成日落色,用 --input 传入图片并写明具体编辑指令。
  • 给内部技术文档生成概念艺术配图,使用默认 Gemini 3.1 Flash Image Preview 模型。
  • 批量产出演示幻灯片所需的写实图片,多次运行脚本并用不同 prompt 和输出路径。

适合人员

  • 做产品视觉的运营:每周要为发布会、社媒推文和官网活动产出封面图与主视觉插画。
  • 写技术文档的工程编辑:需要为文档章节补充概念图、通用配图和可编辑的视觉素材。
  • 做客户汇报的咨询顾问:要把抽象业务流程和方案概念转成清晰插画,并修改现有图片。
  • 独立开发者:需要在 README、演示视频或产品页面中快速生成写实图片并编辑已有图像。