1. 基本信息
| 项目 | 内容 | 数据来源 |
|---|---|---|
| 正式名称 | prompt-governance(合集仓库子技能,见下方说明) | 仓库子目录名 |
| 所属合集仓库 | alirezarezvani/claude-skills | GitHub |
| 作者/维护者 | Alireza Rezvani(仓库维护者);本技能由社区贡献者 chad848 提出雏形,经维护团队整合完善 | GitHub API / PR 记录 |
| 来源链接 | https://github.com/alirezarezvani/claude-skills/tree/main/engineering/prompt-governance/skills/prompt-governance | — |
| 许可证 | MIT | GitHub API |
| 所属仓库整体 Stars / Forks | 23,871 / 3,348(该数字属整个合集,不代表本技能自身热度) | GitHub API |
| 最新版本 | 2.9.0 | 仓库内 plugin.json |
| 该子目录最近一次专门提交 | 2026-05-27 | GitHub Commits API |
| 安装方式 | 见第 10 章 | 官方 README |
2. 功能介绍与亮点
prompt-governance 把生产环境里的提示词(prompt)当作和应用代码同等重要的基础设施来治理:版本化、评测、审计追踪、灰度发布,一套都不少。核心提供三种工作模式:
- 搭建 Prompt 注册表:给出文件型(小团队,YAML 索引 + 版本化 Markdown 文件)与数据库型(大团队,API 可查询)两种注册表方案,覆盖版本历史、环境晋升(dev→staging→prod)、变更审计
- 搭建评测流水线:区分精确匹配、包含检查、LLM 评分、语义相似度、Schema 校验、人工评分六类评测方式,并给出“黄金测试集”的最小样本量与更新周期要求
- 治理化迭代全流程:分支→开发→评测→对比→评审→晋升→监控→回滚八个阶段的完整生命周期,含 A/B 测试的统计显著性要求(p<0.05、最少运行周期)
亮点:① 附一张六项反模式对照表(提示词硬编码进代码、跳过评测直接发布、黄金测试集永不更新、单人垄断提示词知识、A/B 测试事后才定指标、跳过回滚能力),每条都配“为什么失败”与“更好的做法”;② 明确划清与相邻技能的边界——单条提示词的撰写另有 senior-prompt-engineer 负责、检索管线设计另有 rag-architect 负责,本技能只管治理,避免功能蔓延;③ 起源于外部开发者 chad848 的社区贡献,不是纯自产内容。
3. 适用场景
所属分类:工程效率与代码质量
面向已经在生产环境运行多个由提示词驱动的 AI 功能、且提示词数量已经多到“改一处不放心会不会波及别处”的团队。典型场景:把此前全靠一人手改提示词、无版本记录的流程补上注册表与审批环节;给某个 AI 功能上线前补一套自动化评测门禁,防止底层模型升级后功能静默变差却没人发现;对两版提示词做 A/B 测试并按统计显著性下结论,而不是凭感觉切换。不适合只想“写好这一条提示词文案”的用户,那属于 senior-prompt-engineer 的场景。
4. 跨 Agent 兼容性
- Claude Code:原生支持——通过插件市场
/plugin install prompt-governance@claude-code-skills安装,或手动复制到~/.claude/skills/ - Codex:官方文档列出专用安装命令(
npx agent-skills-cli add ... --agent codex),按此步骤安装 - OpenClaw:官方文档列出专用一键安装脚本(
scripts/openclaw-install.sh) - Hermes Agent:官方文档标注为可用,需本地执行一次同步脚本(
sync-hermes-skills.py)安装到~/.hermes/skills/,复用与 Claude Code 相同的 SKILL.md 标准
以上四项均依据仓库 README 逐一列出的官方安装命令判断,未对每个平台逐一实测运行效果。
5. 推荐理由
多数团队对提示词的管理方式还停留在“改代码里的一段字符串、部署、祈祷别出问题”。这份技能把软件工程里成熟的版本控制、评测门禁、灰度发布、一键回滚这套纪律,原样搬到提示词管理上,给出可直接参考的注册表目录结构、评测方式选型表、A/B 测试的统计要求,以及一份“团队最容易踩的六个坑”对照清单。全篇纯文本指导、零外部依赖、零代码执行,装上即可用来审查现有提示词管理方式,或从零搭建一套治理流程。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 6 | 所属仓库整体 23,871 星,但那是合集仓库的热度,不代表本技能自身;本技能自身有一名独立第三方开发者 chad848 最初提出并提交(PR #448),后被仓库团队整合合并(PR #455),但尚无更大范围的独立讨论或第三方媒体报道 |
| 可用性 | 8 | 纯 Markdown 单文件、零依赖、无需 API Key;四个目标 Agent 生态均有官方文档化的独立安装命令;子目录最近一次提交为 2026-05-27 |
| 安全性 | 9 | 检查清单结果见下 |
安全检查清单: ① shell 命令执行——无,纯文本指导内容,不含任何可执行脚本; ② 联网外发——无,不发起任何网络请求,仅指导用户在自己的工程环境内产出制品; ③ API Key/凭据——不索取任何凭据,仅在了解现状阶段询问“当前使用哪个 LLM 厂商”作为背景信息; ④ 可疑指令——未发现 prompt injection 或混淆代码迹象; ⑤ 作者信誉——仓库维护者与本技能原创贡献者均有可查的真实 GitHub 身份与公开 PR 记录,未见刷星或 SEO 操纵措辞; ⑥ License——MIT,仓库与插件清单均有明确声明; ⑦ 最近维护——2026-05-27,落在近 3 个月窗口内。
综合评分 7.7(三项均值)
7. 跟同类 Skills 相比的优势
| 技能 | 定位 | 与本技能的差异 |
|---|---|---|
| promptfoo-evals(promptfoo 官方) | 教 Claude Code 生成 promptfoo 的评测配置与断言,覆盖确定性检查、模型评分式评测、多 provider 对接 | 只覆盖“评测怎么写”这一个环节,不涉及提示词注册表、版本晋升、A/B 测试或回滚这套完整生命周期 |
| prompt-master(nidhinjs) | 输入一句自然语言诉求,自动判定目标 AI 工具并产出一份可直接复制使用的最终提示词 | 服务的是“写好单条提示词”这个环节,不涉及提示词上线后的版本管理与治理 |
| prompt-architect(ckelsoe) | 按 31 种命名提示框架(CO-STAR、Chain of Thought 等)引导用户改写、打分单条提示词 | 同样聚焦“提升单条提示词质量”,产出是改写后的文本而非一套生产治理流程 |
以上三者分别覆盖“写好一条提示词”或“跑一次评测”,而 prompt-governance 处理的是提示词数量变多之后,作为生产基础设施该如何被注册、版本化、评测、灰度发布与回滚的完整生命周期问题。
8. 用户评价
该技能目前在 GitHub Issue 区、Reddit 等平台尚无具名用户评价。多个第三方技能聚合站点收录了该技能的说明页,但均为自动化索引展示,未见附带独立评论内容。
9. 其他补充
所属仓库自述兼容 13 种 Agent 工具(除本文四个平台外还含 Gemini CLI、Cursor、Windsurf、Aider 等),并提供转换脚本适配未原生列出的其他工具。
10. 安装使用方式
Claude Code:
/plugin marketplace add alirezarezvani/claude-skills
/plugin install prompt-governance@claude-code-skills
或手动安装:git clone https://github.com/alirezarezvani/claude-skills.git,将其中的 engineering/prompt-governance 整个文件夹复制到 ~/.claude/skills/。
Codex:npx agent-skills-cli add alirezarezvani/claude-skills --agent codex
OpenClaw:bash <(curl -s https://raw.githubusercontent.com/alirezarezvani/claude-skills/main/scripts/openclaw-install.sh)
Hermes Agent:本地执行一次 python scripts/sync-hermes-skills.py --verbose,同步进 ~/.hermes/skills/
安装后无需重启。技能通过 SKILL.md 中的触发词(如 “prompt versioning”、“prompt registry”、“eval pipeline”)自动激活,首次触发时会先向用户提问一轮关于现状、目标与技术栈的问题,再给出具体方案。
11. 注意事项
- 使用前提是已有一个正在生产环境运行、包含提示词的 AI 功能;纯粹练习撰写单条提示词文案不适用,应改用 senior-prompt-engineer
- 交付物以设计方案与目录结构指导为主(如注册表 YAML schema、评测流水线的实现思路),不含可直接运行的评测脚本,具体评测器仍需用户自行编码落地
- 属合集仓库子技能,若通过按领域打包的插件(如
engineering-skills)整体安装,请自行确认该打包是否包含本技能;若只想获取本技能本身,建议使用上方的手动安装方式或本技能专属的插件条目