图片制作
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_a0de7824/tupian。
技能介绍
需要解决的问题
在AI图像生成领域,开发者或创作者常需要将强大的图像生成能力集成到自己的工具或工作流中。直接对接官方OpenAI API可能面临访问限制、成本或兼容性问题。此技能旨在提供一个基于New API的、完全兼容OpenAI接口规范的本地化解决方案,让你能轻松调用文本生成图片、图片编辑等能力,而无需关心底层复杂的API适配与网络问题。
技能如何工作
该技能封装了一个命令行工具,通过解析参数、发送符合规范的API请求并处理返回结果来完成图像生成任务。
核心能力
- 文本生成图片(T2I):根据文本提示词,调用如
gpt-image-1、dall-e-3等模型生成新图像。 - 图片编辑(I2I):提供一张或多张参考图片,结合新提示词对原图进行修改或再创作。
- 多图融合:传入多张参考图,融合其视觉特征生成全新图像。
- 批量生成:一次请求生成多张内容关联的图片。
关键工作步骤
- 参数解析:从命令行读取提示词(
--prompt)、模型(--model)、尺寸(--size)等参数。 - API请求构造:按照OpenAI
/v1/images/generations接口格式,将参数封装成JSON请求体,并通过环境变量NEWAPI_API_KEY进行认证。 - 结果获取与保存:接收API返回的图片URL或Base64数据,自动下载并保存为PNG等格式的本地文件(可通过
--output指定路径)。
适用边界与注意点
- 依赖与配置:运行需要Node.js 16+环境。使用前必须设置环境变量
NEWAPI_API_KEY,其值需为你在New API平台申请的密钥。 - 模型选择差异:不同模型能力不同。推荐使用
gpt-image-1,它支持背景透明度(--background)和内容审核级别(--moderation)等高级参数。而dall-e-3目前单次请求只能生成一张图(n=1)。 - 错误处理:遇到
401错误通常意味着API Key无效;429表示请求过于频繁。需根据错误代码调整请求或检查密钥状态。 - 参数限制:部分参数(如
--background)仅特定模型支持,使用时需注意模型兼容性。图片尺寸和质量也有API层面的限制。
使用场景
- 在设计一个App界面原型时,需要根据‘简约风格的登录页面’这样的文字描述,快速生成多张不同构图的视觉草案供团队评审。
- 电商运营需要为一批新上架的服装商品,通过上传底图并修改‘背景为海边沙滩’的提示词,批量生成多张风格统一的详情页主图。
- 内容创作者手头有一张建筑草图,希望将其‘渲染成赛博朋克风格的夜景效果图’,用于社交媒体文章的配图。
- 游戏美术需要融合三张不同角色的参考图特征,生成一个‘兼具精灵耳朵与机械铠甲的新人物概念图’,探索新角色设计方向。
适合人员
- 需要快速生成宣传图或视觉草案的**市场营销专员**,常为社交媒体帖子或活动海报寻找灵感与素材。
- 负责产品详情页视觉设计的**电商美工**,需批量制作和优化大量商品展示图,尤其涉及背景更换或风格统一。
- 进行概念设计或草图渲染的**自由插画师/艺术家**,需要将手绘草稿或文字想法快速转化为不同风格的数字图像。
- 从事建筑可视化或室内效果图设计的**设计师**,需要将线框草图快速渲染成不同风格的效果图进行方案比选。