我做了2个GPT-image-2生图Skills,帮助Agent实现生图,安装简单
公众号名称:无处不在的技术
作者名称:爱海贼的无处不在
发布时间:2026-04-26 23:02
持续内容输出,点击蓝字关注我吧
01
前言
来看一段AI大模型对它的介绍
最近OpenAI的GPT-image-2生图模型正在全网爆火,如今OpenAI拼接文本生成模型GPT5.5、图片生成模型GPT-image-2再次证明了自己的领先地位。
最近几个月也一直在使用AI生图,这次新图片模型发布,基于国内的API易代理站平台,我封装了2个AgentSkills,可以通过Skills的方式调用API实现生图。无需访问外网,感兴趣的也可以下载使用。
目前API易网站提供了2种方式,官逆版和官转版。对比介绍如下:

gpt-image-2-all 是 API易 平台上线的一款 GPT 图像生成官逆模型。以 $0.03/张 的极具竞争力的按次计费定价,约 30 秒出图,支持 文生图 / 单图编辑 / 多图融合 / 自然语言改图,文字还原度高、内容限制少、原生支持中文提示词。
gpt-image-2 是 OpenAI 最新旗舰图像生成模型,是 gpt-image-1.5 的升级版。核心升级:任意合法分辨率(含 2K / 3840×2160 4K)、参考图自动高保真、同档降价 20-30%。API易 网关完整兼容 OpenAI Images API,OpenAI 官方 SDK 把 base_url 指过来即可零代码改动直连。
封装的2个模型对比如下:

因此我设计AgentSkills的时候也设计了2个。
目前设计开发的AgentSkills已经被API社区收录,可以提前阅读:
https://docs.apiyi.com/scenarios/ecosystem/apiyi-gpt-image-skills
也可以访问API易网站的在线画图页面:
目前最近几个月我用的这个网站都是非常稳定的,之前生成了大量的图片。
目前我开发的2个GPT-Image-2的技能AgentSkill如下:
apiyi-gpt-image-2-gen 与 apiyi-gpt-image-2-all-gen
开源Github项目地址为:
https://github.com/wuchubuzai2018/expert-skills-hub
针对API易代理站提供的2个生图模型,可以根据自己的情况选择场景:

为什么选 API易 的 GPT-image-2 官转,官方介绍如下:

本文分享一下这两个Skills。
02
正文
正文
目前分别已上架到Skills.sh和Clawhub:
skills.sh上:
基于API易代理站官逆版的Skills安装命令如下:
npx skills add https://github.com/wuchubuzai2018/expert-skills-hub —skill apiyi-gpt-image-2-all-gen
基于API易代理站安装管转版的命令如下:
npx skills add https://github.com/wuchubuzai2018/expert-skills-hub —skill apiyi-gpt-image-2-gen
clawhub上:
如下几个安装命令都可以:
openclaw skills install wuchubuzai2018/apiyi-gpt-image-2-all-gen
npx clawhub@latest install apiyi-gpt-image-2-all-gen
openclaw skills install wuchubuzai2018/apiyi-gpt-image-2-gen
npx clawhub@latest install apiyi-gpt-image-2-gen
截图:

两个 Skill 如何选?
-
apiyi-gpt-image-2-gen****(官转,推荐):可控size / quality / output-format / compression,支持 4K(3840×2160)、自定义尺寸、mask 语义编辑,按 token 计费——适合有明确画质/尺寸要求的场景 -
apiyi-gpt-image-2-all-gen****(官逆):仅需prompt+ 可选response-format,通过 Prompt 描述尺寸/比例,按次计费($0.03 / 次),与 ChatGPT 网页版体验一致——适合自然语言直出、文字还原、多轮改图
两个 Skill 依赖什么环境?
依赖:Node.js 或Python ,脚本同时提供 generate_image.js 与 generate_image.py,存在Node或Python环境任意即可。
环境变量: APIYI_API_KEY 一次设置,全局可用;也支持 -k 命令行临时覆盖
两个 Skill 支持的API易模型情况
模型名称 | 模型标识 | 对应 Skill |
GPT-Image 2(官转,推荐) | gpt-image-2 | apiyi-gpt-image-2-gen |
GPT-Image 2 All(官逆) | gpt-image-2-all | apiyi-gpt-image-2-all-gen |
如果需要绝对精度高度的场景,需要使用官转版本。
对于目前开发的apiyi-gpt-image-2-gen(官转)这个Skills来说,在技能中封装的工具支持如下参数:

apiyi-gpt-image-2-all-gen(官逆)的命令行参数如下:

我们可以下载安装技能后,配置好系统环境变量后,对模型说:
-
“用 apiyi-gpt-image-2-gen 生成一张 3840x2160、high 质量的赛博朋克城市壁纸”
-
“调用 apiyi-gpt-image-2-all-gen,把 photo.jpg 改成吉卜力动画风格”
-
“用生图Skill 生成一张 logo,1:1,high 质量,png格式”
当前这两个Skills中,我也提供了批量生图的提示词,当我们批量生图的时候或者提前规划好生图的提示词后,会先生成一个提示词的JSON,Skills会根据当前的步骤进行提取进行生图
当用户需要一次性生成多张图片时,可使用本文档定义的 JSON 格式配置批量生成任务。
{
"description": "批量任务描述(可选)",
"global": {
"quality": "high",
"size": "1024x1024",
"output_format": "png"
},
"prompts": [
{
"prompt": "提示词1描述",
"filename": "output1.png",
"size": "1024x1024",
"quality": "high",
"output_format": "png"
},
{
"prompt": "提示词2描述",
"filename": "output2.png",
"size": "2048x2048",
"quality": "high"
}
]
}
我们可以通过可以提前准备好这个配置文件,或者让AI生成:
{
"description": "生成同一场景的不同风格版本",
"global": {
"quality": "high",
"size": "2048x1152",
"output_format": "png"
},
"prompts": [
{
"prompt": "山间日出风景,写实摄影风格",
"filename": "sunrise_realistic.png"
},
{
"prompt": "山间日出风景,水彩画风格",
"filename": "sunrise_watercolor.png"
},
{
"prompt": "山间日出风景,动漫插画风格",
"filename": "sunrise_anime.png"
}
]
}
我这里我用的是opencode,让他帮我整理下MCP、RAG、Skills的相关知识,我准备的JSON提示词文件如下:
{
"description": "小黄人风格AI概念科普图 - MCP、RAG、Skills",
"global": {
"response_format": "url"
},
"prompts": [
{
"prompt": "竖版 9:16 手机海报。一个可爱的小黄人穿着精致的蓝色小西装,打着红色领结,像个小管家一样站在中间。左右两边分别是代表AI服务商的彩色图标和代表本地工具的图标。小黄人双手指向中间发光的连接线,线和图标之间有小小的齿轮和接口在转动。头顶有对话框显示'我来帮你连接!'。背景是简洁的浅色系科技风,周围有其他小黄人在开心地工作。整个画面明亮欢乐,清晰传达MCP是AI世界的连接器,帮助不同服务互相沟通的概念。",
"filename": "mcp_explanation.png"
},
{
"prompt": "竖版 9:16 手机海报。一个戴着眼镜的小黄人学者站在巨大的知识图书馆前,手里拿着一个发光的放大镜。放大镜指向漂浮在空中的各种知识碎片(文档、图片、代码片段),这些碎片正变成闪闪发光的文字飞入小黄人手中的书本。在小黄人旁边有一个对话框显示'查找知识+AI回答=完美答案!'。背景是层层叠叠的书架和发光的搜索路径。画面温暖明亮,清晰传达RAG=检索知识+AI生成回答的概念。",
"filename": "rag_explanation.png"
},
{
"prompt": "竖版 9:16 手机海报。一个神气的小黄人站在技能展示台上,头戴工程师安全帽,身穿魔法披风,手里拿着画笔,旁边环绕着各种工具:键盘、放大镜、试管、画笔、扳手、魔杖等。每样工具都闪着不同颜色的光。在小黄人前方有一个展示牌写着'需要什么技能,就用什么技能!'。背景是热闹的技能工坊,墙上挂满了各种技能徽章。画面丰富多彩充满活力,清晰传达Skills=让AI掌握各种专业技能来帮你完成不同任务的概念。",
"filename": "skills_explanation.png"
}
]
}
最后生成的几个图片效果如下:
MCP的介绍:

RAG的介绍:

目前感觉OpenAI对于提示词限制比较高,我这里写多次会出现失败的情况,感觉是小黄人这个风格的问题。
目前用我这个Skills的一个经验是大概这样话术,客户端工具不会自己进行提示词的加工:
使用AI生图技能,提示词如下:xxxxxx
当前我做的这个Skills,也支持图生图,也可以让这个技能触发图生图的处理,例如我让它将我的Skills介绍转换下,原图如下:

执行截图:

最后AI将我的目前已经开发的Skills实现转换,效果也不错的:

03
正文
总结
本文分享了我制作的2个Skills,感兴趣的可以尝试使用API易官方的服务进行使用,不需要访问外网。
**喜欢本文的,可以关注、收藏、点赞、转发、分享到朋友圈哦。
**
- END -
喜欢的可以加入我的免费知识星球与我一起学习相关开发技术:觉醒的新世界程序员,或者我的付费知识星球获取与了解AI技术、AI图片生成等内容哦:觉醒的AI技术经验,随时与我沟通,交流技术与想法。

喜欢的也可以关注我的公众号:无处不在的技术,与我一起学习成长、共同进步,在技术的道路上越走越远。
喜欢就点个 在看****呗 👇2
Original 爱海贼的无处不在 无处不在的技术