Clipping 微信公众号

我做了2个GPT-image-2生图Skills,帮助Agent实现生图,安装简单

by 爱海贼的无处不在 原文 ↗
Created: 2026-04-26

公众号名称:无处不在的技术

作者名称:爱海贼的无处不在

发布时间:2026-04-26 23:02

持续内容输出,点击蓝字关注我吧

01

前言

来看一段AI大模型对它的介绍

最近OpenAI的GPT-image-2生图模型正在全网爆火,如今OpenAI拼接文本生成模型GPT5.5、图片生成模型GPT-image-2再次证明了自己的领先地位。

最近几个月也一直在使用AI生图,这次新图片模型发布,基于国内的API易代理站平台,我封装了2个AgentSkills,可以通过Skills的方式调用API实现生图。无需访问外网,感兴趣的也可以下载使用。

目前API易网站提供了2种方式,官逆版和官转版。对比介绍如下:

gpt-image-2-all 是 API易 平台上线的一款 GPT 图像生成官逆模型。以 $0.03/张 的极具竞争力的按次计费定价,约 30 秒出图,支持 文生图 / 单图编辑 / 多图融合 / 自然语言改图,文字还原度高、内容限制少、原生支持中文提示词。

gpt-image-2 是 OpenAI 最新旗舰图像生成模型,是 gpt-image-1.5 的升级版。核心升级:任意合法分辨率(含 2K / 3840×2160 4K)参考图自动高保真同档降价 20-30%。API易 网关完整兼容 OpenAI Images API,OpenAI 官方 SDK 把 base_url 指过来即可零代码改动直连。

封装的2个模型对比如下:

因此我设计AgentSkills的时候也设计了2个。

目前设计开发的AgentSkills已经被API社区收录,可以提前阅读:

https://docs.apiyi.com/scenarios/ecosystem/apiyi-gpt-image-skills

也可以访问API易网站的在线画图页面:

https://imagen.apiyi.com

目前最近几个月我用的这个网站都是非常稳定的,之前生成了大量的图片。

目前我开发的2个GPT-Image-2的技能AgentSkill如下:

apiyi-gpt-image-2-genapiyi-gpt-image-2-all-gen

开源Github项目地址为:

https://github.com/wuchubuzai2018/expert-skills-hub

针对API易代理站提供的2个生图模型,可以根据自己的情况选择场景:

为什么选 API易 的 GPT-image-2 官转,官方介绍如下:

本文分享一下这两个Skills。

02

正文

正文

目前分别已上架到Skills.sh和Clawhub:

skills.sh上:

基于API易代理站官逆版的Skills安装命令如下:

npx skills add https://github.com/wuchubuzai2018/expert-skills-hub —skill apiyi-gpt-image-2-all-gen

基于API易代理站安装管转版的命令如下:

npx skills add https://github.com/wuchubuzai2018/expert-skills-hub —skill apiyi-gpt-image-2-gen

clawhub上:

如下几个安装命令都可以:

openclaw skills install wuchubuzai2018/apiyi-gpt-image-2-all-gen

npx clawhub@latest install apiyi-gpt-image-2-all-gen

openclaw skills install wuchubuzai2018/apiyi-gpt-image-2-gen

npx clawhub@latest install apiyi-gpt-image-2-gen

截图:

两个 Skill 如何选?

  • apiyi-gpt-image-2-gen****(官转,推荐):可控 size / quality / output-format / compression,支持 4K(3840×2160)、自定义尺寸、mask 语义编辑,按 token 计费——适合有明确画质/尺寸要求的场景

  • apiyi-gpt-image-2-all-gen****(官逆):仅需 prompt + 可选 response-format,通过 Prompt 描述尺寸/比例,按次计费($0.03 / 次),与 ChatGPT 网页版体验一致——适合自然语言直出、文字还原、多轮改图

两个 Skill 依赖什么环境?

依赖:Node.js 或Python ,脚本同时提供 generate_image.jsgenerate_image.py,存在Node或Python环境任意即可。

环境变量: APIYI_API_KEY 一次设置,全局可用;也支持 -k 命令行临时覆盖

两个 Skill 支持的API易模型情况

模型名称
模型标识
对应 Skill
GPT-Image 2(官转,推荐)
gpt-image-2
apiyi-gpt-image-2-gen
GPT-Image 2 All(官逆)
gpt-image-2-all
apiyi-gpt-image-2-all-gen

如果需要绝对精度高度的场景,需要使用官转版本。

对于目前开发的apiyi-gpt-image-2-gen(官转)这个Skills来说,在技能中封装的工具支持如下参数:

apiyi-gpt-image-2-all-gen(官逆)的命令行参数如下:

我们可以下载安装技能后,配置好系统环境变量后,对模型说:

  • “用 apiyi-gpt-image-2-gen 生成一张 3840x2160、high 质量的赛博朋克城市壁纸”

  • “调用 apiyi-gpt-image-2-all-gen,把 photo.jpg 改成吉卜力动画风格”

  • “用生图Skill 生成一张 logo,1:1,high 质量,png格式”

当前这两个Skills中,我也提供了批量生图的提示词,当我们批量生图的时候或者提前规划好生图的提示词后,会先生成一个提示词的JSON,Skills会根据当前的步骤进行提取进行生图

当用户需要一次性生成多张图片时,可使用本文档定义的 JSON 格式配置批量生成任务。

{
"description": "批量任务描述(可选)",
"global": {
"quality": "high",
"size": "1024x1024",
"output_format": "png"
},
"prompts": [
{
"prompt": "提示词1描述",
"filename": "output1.png",
"size": "1024x1024",
"quality": "high",
"output_format": "png"
},
{
"prompt": "提示词2描述",
"filename": "output2.png",
"size": "2048x2048",
"quality": "high"
}
]
}

我们可以通过可以提前准备好这个配置文件,或者让AI生成:

{
"description": "生成同一场景的不同风格版本",
"global": {
"quality": "high",
"size": "2048x1152",
"output_format": "png"
},
"prompts": [
{
"prompt": "山间日出风景,写实摄影风格",
"filename": "sunrise_realistic.png"
},
{
"prompt": "山间日出风景,水彩画风格",
"filename": "sunrise_watercolor.png"
},
{
"prompt": "山间日出风景,动漫插画风格",
"filename": "sunrise_anime.png"
}
]
}

我这里我用的是opencode,让他帮我整理下MCP、RAG、Skills的相关知识,我准备的JSON提示词文件如下:

{
"description": "小黄人风格AI概念科普图 - MCP、RAG、Skills",
"global": {
"response_format": "url"
},
"prompts": [
{
"prompt": "竖版 9:16 手机海报。一个可爱的小黄人穿着精致的蓝色小西装,打着红色领结,像个小管家一样站在中间。左右两边分别是代表AI服务商的彩色图标和代表本地工具的图标。小黄人双手指向中间发光的连接线,线和图标之间有小小的齿轮和接口在转动。头顶有对话框显示'我来帮你连接!'。背景是简洁的浅色系科技风,周围有其他小黄人在开心地工作。整个画面明亮欢乐,清晰传达MCP是AI世界的连接器,帮助不同服务互相沟通的概念。",
"filename": "mcp_explanation.png"
},
{
"prompt": "竖版 9:16 手机海报。一个戴着眼镜的小黄人学者站在巨大的知识图书馆前,手里拿着一个发光的放大镜。放大镜指向漂浮在空中的各种知识碎片(文档、图片、代码片段),这些碎片正变成闪闪发光的文字飞入小黄人手中的书本。在小黄人旁边有一个对话框显示'查找知识+AI回答=完美答案!'。背景是层层叠叠的书架和发光的搜索路径。画面温暖明亮,清晰传达RAG=检索知识+AI生成回答的概念。",
"filename": "rag_explanation.png"
},
{
"prompt": "竖版 9:16 手机海报。一个神气的小黄人站在技能展示台上,头戴工程师安全帽,身穿魔法披风,手里拿着画笔,旁边环绕着各种工具:键盘、放大镜、试管、画笔、扳手、魔杖等。每样工具都闪着不同颜色的光。在小黄人前方有一个展示牌写着'需要什么技能,就用什么技能!'。背景是热闹的技能工坊,墙上挂满了各种技能徽章。画面丰富多彩充满活力,清晰传达Skills=让AI掌握各种专业技能来帮你完成不同任务的概念。",
"filename": "skills_explanation.png"
}
]
}

最后生成的几个图片效果如下:

MCP的介绍:

RAG的介绍:

目前感觉OpenAI对于提示词限制比较高,我这里写多次会出现失败的情况,感觉是小黄人这个风格的问题。

目前用我这个Skills的一个经验是大概这样话术,客户端工具不会自己进行提示词的加工:

使用AI生图技能,提示词如下:xxxxxx

当前我做的这个Skills,也支持图生图,也可以让这个技能触发图生图的处理,例如我让它将我的Skills介绍转换下,原图如下:

执行截图:

最后AI将我的目前已经开发的Skills实现转换,效果也不错的:

03

正文

总结

本文分享了我制作的2个Skills,感兴趣的可以尝试使用API易官方的服务进行使用,不需要访问外网。

**喜欢本文的,可以关注、收藏、点赞、转发、分享到朋友圈哦。
**

- END -

喜欢的可以加入我的免费知识星球与我一起学习相关开发技术:觉醒的新世界程序员,或者我的付费知识星球获取与了解AI技术、AI图片生成等内容哦:觉醒的AI技术经验,随时与我沟通,交流技术与想法。

喜欢的也可以关注我的公众号:​无处不在的技术​,与我一起学习成长、共同进步,在技术的道路上越走越远。

喜欢就点个 在看****呗 👇2


Original 爱海贼的无处不在 无处不在的技术

输入关键词开始搜索