1. 基本信息
| 项目 | 内容 | 数据来源 |
|---|---|---|
| 正式名称 | agentic-harness-patterns-skill | GitHub 仓库名 |
| 作者/维护者 | keli-wen(独立开发者) | GitHub API |
| 来源链接 | https://github.com/keli-wen/agentic-harness-patterns-skill | — |
| 许可证 | MIT | GitHub API |
| GitHub Stars / Forks | 296 / 48 | GitHub API |
| 最新版本 | 1.0.0(SKILL.md 内 metadata 声明,无独立 Git Release/Tag) | 仓库 metadata.json |
| 最近提交 | 2026-04-02(初始发布后未再更新) | GitHub API |
| 安装方式 | 见第十章 | 官方 README |
2. 功能介绍与亮点
agentic-harness-patterns-skill 是一份从 Claude Code 运行时源码(约 51.2 万行 TypeScript)系统性逆向分析中提炼出的 Agent Harness 设计模式参考手册,以英文/中文两个版本的 SKILL.md 呈现,配 11 篇深挖参考文档。核心覆盖六层:
- 记忆(Memory):区分“指令记忆”(人工维护的项目规范)、“自动记忆”(Agent 自主写入)、“会话抽取”(后台从对话中提炼),三层各自的可信度与生命周期不同
- 技能(Skills):技能应“懒加载”——元数据常驻、正文按需加载,触发语言要前置,避免因描述过长被截断
- 工具与安全(Tools and Safety):权限判定应“默认拒绝”,并发许可要按调用而非按工具粒度判断
- 上下文工程(Context Engineering):把上下文当预算而非无限容器,围绕“选择/写入/压缩/隔离”四种操作组织
- 多 Agent 协同(Multi-agent Coordination):区分 Coordinator(全新上下文)、Fork(继承父上下文,仅一层)、Swarm(对等通信)三种委派模式,并强调协调者要“综合归纳”而非简单转发
- 生命周期与可扩展性(Lifecycle):Hook 的信任是“全有或全无”,后台任务要有严格状态机
每章都配“何时用”、“怎么做”、“取舍”与“深挖链接”,末尾附 10 条易踩坑的“Gotchas”清单和一节“本技能不适用于哪些场景”的诚实边界说明。
3. 适用场景
所属分类:元技能与 Agent 增强
面向正在构建或扩展 Agent 运行时本身的工程师——无论是自研编码 Agent、给现有 Agent 加插件/子 Agent 编排能力,还是想理解 Claude Code 这类生产系统“模型循环之外”的工程决策。典型场景包括:设计跨会话的记忆持久化方案时避免“越用越臃肿”、给 Agent 接入新工具前先想清楚并发与权限默认值、长任务上下文快爆表时决定该压缩还是隔离、拆分多 Agent 协作任务时避免“我把发现丢给你,你去修”这类甩锅式委派。不适合单纯想学“怎么写提示词”或“选哪个模型”的用户。
4. 跨 Agent 兼容性
- Claude Code:原生支持——内容本身基于 Claude Code 源码逆向分析产出,正文明确引用
/remember、/update-config等 Claude Code 专属命令 - Codex:可通过通用安装器
npx skills add安装,但仓库描述明确标注“Codex CLI 深度分析仍在路线图(roadmap)中”,即当前内容主要以 Claude Code 实现为证据来源,Codex 场景下的适配程度未验证 - OpenClaw / Hermes Agent:README 仅笼统提及“兼容 40+ 个 Agent”,未点名验证这两者,未验证
5. 推荐理由
多数团队摸索 Agent Harness 设计都是“边踩坑边攒经验”,很少有人把一个生产级系统的架构决策系统性拆解成可复用的设计原则。这份技能把 Claude Code 背后的记忆分层、权限默认值、上下文预算、多 Agent 委派模式等隐性工程知识显性化,且每条原则都标注“何时用”与“取舍”而非空泛的最佳实践口号。对正在设计自己的 Agent 系统、或想让 Claude Code 在讨论架构决策时有据可依的中高级开发者,这是一份能直接对照自查的清单。全篇纯 Markdown 参考内容,无代码执行、无外联、无凭据依赖,安装成本几乎为零。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 5 | GitHub 296 stars(落在 200–1k 区间),但仓库 Issue 区为空,第三方技能目录 skillsllm.com 收录页也显示零用户评论,未找到独立讨论 |
| 可用性 | 8 | 单命令安装(npx skills add)、零外部依赖、双语文档外加 11 篇参考文档,结构清晰;但自 2026-04-02 首发后再无任何后续提交 |
| 安全性 | 9 | 纯 Markdown 参考内容,无 Shell 命令执行、无网络外发、不要求任何 API Key 或凭据;通读全文未发现可疑指令或混淆代码;License 明确;作者账号自 2022 年注册,非新建马甲号 |
安全检查清单:①无 shell 执行 ②无网络外发 ③不要求凭据 ④全文复核无可疑指令 ⑤作者信誉正常,无刷星或造假迹象 ⑥License 明确(MIT)⑦自 2026-04-02 起无后续提交,但内容为静态参考文档,无因维护停滞产生的漏洞风险
综合评分 = 三项均值 = 7.3
7. 跟同类 Skills 相比的优势
| 对比对象 | 定位 | 与本技能的差异 |
|---|---|---|
| Agent-Skills-for-Context-Engineering(muratcankoylan,17,273★,17 个子技能) | 专精“上下文工程”单一主题,按基础/架构/运行/方法四组拆成 17 个独立子技能,社区规模大(10 位贡献者) | 本技能覆盖记忆、技能、工具安全、上下文、多 Agent、生命周期六大主题,广度更全但单一主题深度不及对方;适合先建立整体心智模型,再按需查阅专精子技能 |
| skill-creator(Anthropic 官方,隶属 anthropics/skills 合集仓库) | 提供五阶段流程和“带 skill / 不带 skill”A-B 测试脚本,解决“如何验证一个 skill 是否真的有效” | 是一套可执行的技能创作与测试工具,产出可运行的基准测试;本技能是纯阅读型架构原则参考手册,不含任何脚本,回答的是“Harness 该怎么设计”而非“怎么测试一个 skill” |
8. 用户评价
该技能目前在 GitHub Issue 区与第三方技能收录平台(skillsllm.com)均无具名用户评论。skillsllm.com 页面显示其已通过该平台的自动化安全扫描(含依赖漏洞审计与 prompt-injection 启发式检测),未发现高危问题,可作为独立于作者自述的安全性佐证。
9. 其他补充
仓库提供英文(README.md)与中文(README_ZH.md)双语文档,SKILL.md 本身也有对应的中文版本(agentic-harness-patterns-zh)。首个版本一次性发布了全部 6 章内容与 11 篇参考文档,随附一篇《蒸馏实践日志》说明作者如何用 Codex 与 Claude Code 协作、通过类 PCA 的降维方法提炼出这些模式。
10. 安装使用方式
- 通用安装器(推荐,支持 Claude Code / Codex 等 40+ 个 Agent):
npx skills add keli-wen/agentic-harness-patterns-skill - 手动安装:克隆仓库后,将
skills/agentic-harness-patterns/(或中文版skills/agentic-harness-patterns-zh/)整个目录复制到你的 Agent 技能目录下 - 安装后无需重启、无需配置任何 API Key;技能会在对话涉及“记忆持久化”“权限管道”“上下文预算”“多 Agent 委派”“Hook 生命周期”等触发词时被自动激活
11. 注意事项
- 内容定位是“设计原则参考”,不是可执行工具——它不会替你写代码或跑测试,只提供决策时可对照的模式与取舍
- 首发后暂无后续更新(最近一次提交为 2026-04-02),若上游 Claude Code 的具体实现细节有大幅变化,文中部分描述可能与最新版本存在出入
- 内容以 Claude Code 的实现作为主要论据来源,虽然作者声明原则本身“运行时无关”,但 Codex/OpenClaw/Hermes Agent 场景下的适配程度尚未有实证验证
- 目前缺乏独立于作者自述之外的第三方用户使用反馈,建议先小范围试用判断是否契合自己的技术栈