1. 基本信息
| 项目 | 内容 |
|---|---|
| 名称 | GPT-Image2-Skill |
| 作者/维护者 | wuyoscar(独立开发者) |
| 来源链接 | https://github.com/wuyoscar/GPT-Image2-Skill |
| 许可证 | MIT License(仓库 LICENSE 文件确认) |
| GitHub Stars | 3,850(GitHub API 实测) |
| Forks | 324(GitHub API 实测) |
| 最新版本 | v0.2.0(2026-04-25 发布,之后仍有持续提交,最近一次提交在 2026-07-20) |
| 安装方式 | Claude Code 插件市场一条命令 / Codex $skill-installer 或 npx skills / 手动克隆符号链接 |
项目自述名称即为「GPT Image 2 Prompt Gallery + Agentic Skill + CLI」,正式名称按仓库名机械确定为 GPT-Image2-Skill(GitHub 独立仓库)。
2. 功能介绍与亮点
这是一款围绕 OpenAI GPT Image 2 模型打造的“提示词图库 + Agent 技能 + 命令行工具”三合一项目——Agent 收到画图请求后,先在仓库自带的 162 条精选提示词图库中检索匹配范式,再调用打包好的 CLI 完成生成或编辑,而不是让模型现场瞎编图像生成代码。
- 场景化提示词图库:覆盖论文配图、UI 原型、游戏 HUD、海报排版、中文文字、多图参考编辑等 12+ 类实际创作场景,每条都附带可复制的完整 Prompt 原文与效果预览
- 完整 CLI 工具链:支持文生图、参考图编辑、蒙版局部重绘(inpaint)三种模式,尺寸/质量/输出格式等参数均有清晰说明
- 克制的密钥与安装纪律:明确要求“先检测已安装状态、不盲目覆盖已有技能目录、不擅自写入或打印密钥”,全局安装需用户显式选择,这套安装前置检查在同类技能中并不常见
- 双语文档:README 提供中英文双版本,且有独立的贡献指南、安全策略文件
- 亮点:第三方开源热度追踪站 oosmetrics 将其列为 Agent/LLM/CLI 三个榜单的“按增速排名第一”项目,近三个月保持每周级别的提交与发版节奏
3. 适用场景
固定分类:内容创作与知识管理——核心功能是围绕图像内容生成/编辑的创作辅助,精确落入本分类“内容创作”的范畴。
适用于需要在 Claude Code / Codex 等 Agent 内直接生成或编辑配图的用户:写论文/报告需要示意图和数据可视化配图的研究者、写技术博客需要头图和示意图的作者、做产品原型需要 UI Mockup 的开发者,以及需要批量生成社交媒体海报、游戏素材、活动地图等创意资产的内容创作者。
4. 跨 Agent 兼容性
- Claude Code:✅ 原生支持——README 提供
/plugin marketplace add+/plugin install两条命令直接安装 - Codex:✅ 原生支持——可通过 Codex 内置的
$skill-installer助手一步安装,或用npx skills@latest add ... --agent codex安装 - OpenClaw:✅ 原生支持——SKILL.md 的 metadata 字段专门声明了
"openclaw"运行时配置,且提供npx skills@latest add ... --agent openclaw的对应安装命令 - Hermes Agent:❓ 未验证——README 仅给出“使用该运行时自己的技能目录”这一通用手动安装说明,未见针对 Hermes Agent 的专门安装命令或测试记录
5. 推荐理由
在 Agent 里画图时先查一遍 162 条实战验证过的提示词范式,再用打包好的 CLI 一步生成,不用现场瞎编生成代码。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 8 | 独立仓库专属这一个技能(非合集,星数可直接记给它本身),GitHub 3,850 星、324 fork;第三方热度追踪站将其列为多个榜单按增速排名第一,且近三个月持续有真实用户在 Issue 中反馈使用体验 |
| 可用性 | 8 | Claude Code / Codex / OpenClaw 均提供一条命令安装;双语文档、CLI 参数表齐全;提交记录显示 2026-07-20 仍在更新;需自备 OPENAI_API_KEY 且调用会产生 OpenAI 官方计费 |
| 安全性 | 8 | 见下方安全检查清单 |
安全检查清单逐项:①仅执行打包好的图像生成 CLI 命令,不做任意 shell 操作,权限范围明确;②会联网调用 OpenAI 官方图像生成 API,此为技能核心功能且用途完全透明,无隐蔽外发;③需要 OPENAI_API_KEY,SKILL.md 明确写明“从环境变量/.env 读取但从不覆盖已有值、从不打印密钥值、不擅自新建或修改密钥文件”,并给出“如不想使用本地 CLI,运行 unset OPENAI_API_KEY“的具体规避方法;④已通读 SKILL.md 与 README 全文,未发现提示注入或要求执行额外操作的可疑指令;⑤作者为个人开发者但工程规范完整(CONTRIBUTING、SECURITY、CODE_OF_CONDUCT 齐备),在 GitHub Issue 中对用户反馈响应及时、态度专业;⑥MIT 许可证明确;⑦最近一次提交在 2026-07-20,维护活跃度高。
综合评分:8.0(三项均值,四舍五入至一位小数)
7. 跟同类 Skills 相比的优势
| 名称 | 定位 | 与本技能的差异 |
|---|---|---|
| GPT-Image2-Skill(本次推荐) | 围绕 OpenAI GPT Image 2 模型的精选提示词图库 + CLI + Agent 技能 | —— |
| nano-banana-pro-prompts-recommend-skill | 基于 Gemini “Nano Banana Pro” 模型、收录超过 10,000 条提示词的智能推荐技能,支持按用例检索与内容改编 | 底层模型不同(Gemini 而非 GPT Image 2),走“海量提示词库+推荐算法”路线;仓库未见明确开源许可证 |
| banana-claude | 同样基于 Gemini 的 Claude Code 图像生成技能,定位为“AI 创意总监” | 聚焦创意方向把控与风格建议,不提供独立可脱离 Agent 使用的 CLI 工具 |
| smart-illustrator | 专注“给文章配图”这一垂直场景,带智能版式检测与封面学习系统 | 场景更窄——只服务博客/文章插图流程,不覆盖论文图、UI 原型、游戏素材等多元创作场景 |
差异化总结:同类技能大多依赖 Gemini 系模型或聚焦单一场景,GPT-Image2-Skill 是目前围绕 GPT Image 2 模型、覆盖场景最广且工程化程度最高的选择,尤其是密钥安全处理与安装前置检查的严谨程度在同类项目里较为突出。
8. 用户评价
- 开发者 ayoubelmhamdi 在 GitHub Issue #12 中反馈:实际使用中曾出现 Agent 未触发本技能、转而现场生成调用 OpenAI SDK 的 Python 代码这一问题;作者在 2026-05-04 当日即回应会加强技能触发描述的匹配精度,ayoubelmhamdi 随后也分享了“如担心密钥被误用可执行
unset OPENAI_API_KEY“这一实用规避方法,该建议后来被作者写入了正式文档 - 该技能目前在第三方平台尚无更多具名用户评价
9. 其他补充
仓库同时维护双语(英文/中文)README,切换入口在文档顶部;CHANGELOG 记录了从初次发布到 v0.2.0 的完整迭代历程,包括图库拆分、安装说明打磨、密钥处理安全加固等具体变更点。
10. 安装使用方式
# Claude Code
/plugin marketplace add wuyoscar/gpt_image_2_skill
/plugin install gpt-image@wuyoscar-skills
# Codex(内置助手一步安装)
$skill-installer
Install this skill from GitHub:
https://github.com/wuyoscar/gpt_image_2_skill/tree/main/skills/gpt-image
# 跨运行时通用安装器(Codex / OpenClaw)
npx --yes skills@latest add wuyoscar/gpt_image_2_skill --skill gpt-image --agent codex --copy
npx --yes skills@latest add wuyoscar/gpt_image_2_skill --skill gpt-image --agent openclaw --copy
# 独立 CLI(无需安装为技能也可直接用)
uvx --from git+https://github.com/wuyoscar/gpt_image_2_skill gpt-image -p "a cat astronaut"
安装后无需重启 Agent 会话即可生效;首次使用前需设置环境变量 OPENAI_API_KEY,调用图像生成/编辑接口会按 OpenAI 官方定价产生费用,请提前确认预算。
11. 注意事项
- 依赖 OpenAI GPT Image 2 API,需自备 API Key 且会产生官方计费,不适合完全不想接触外部计费的用户
- Codex 自带内置的图像生成能力,与本技能是两条独立路径,二者可能出现“该由谁响应画图请求”的触发竞争,已有真实用户反馈过这一情况(见第 8 章),作者正在持续优化触发描述的精确度
- Hermes Agent 的兼容性目前未见官方说明或测试记录,如需在该运行时使用建议先手动小范围验证
- README 明确提醒:生成的论文配图应作为示意/风格参考,不建议未经处理直接用于正式学术出版物