1. 基本信息
| 项目 | 内容 |
|---|---|
| 名称 | distributed-system-testing |
| 作者/维护者 | Li Shen(shenli,PingCAP 工程师) |
| 来源链接 | https://github.com/shenli/distributed-system-testing |
| 许可证 | MIT(GitHub API) |
| GitHub Stars | 223(GitHub API) |
| Forks | 12(GitHub API) |
| 最新版本 | 无正式 release 标签,按 commit 追踪:6414861(2026-07-21,GitHub API) |
| 安装方式 | 一条 shell 脚本(git clone + 按 Agent 类型自动挂载) |
2. 功能介绍与亮点
面向分布式与有状态系统的测试方法论,由两个耦合技能组成:设计计划与执行计划出报告,通过文件产物衔接。
核心亮点:
- 以产品“承诺”驱动:先梳理对外声明的保证(一致性、幂等、持久性等),再设计试图证伪每条声明的场景
- 覆盖充分性作为交付物:计划末尾须论证“场景为何足以放行”,并诚实列出未验证项
- 模型 + 操作历史 + checker 三件套:一致性/幂等场景须绑定抽象模型与具名 checker,避免“脚本跑完就算过”
- 十态判定 + 责任归属标签:FAIL 附带 SUT/harness/checker/environment 责任分类
- 自带 8 篇技术目录 + 16 项常见坑参考资料,覆盖混沌注入、TLA+、Jepsen/Elle 等
3. 适用场景
所属分类:工程效率与代码质量
面向需要为分布式/有状态系统(数据库、消息队列、共识组件、多租户后端)设计并执行测试计划的工程师,适合需覆盖网络分区、崩溃恢复、幂等重放、时序竞争等场景的团队。支持变更范围与项目级两种模式。
4. 跨 Agent 兼容性
| Agent | 结论 | 依据 |
|---|---|---|
| Claude Code | 原生支持 | INSTALL.md 提供专用步骤:把每个技能目录软链接到 ~/.claude/skills/,自动被 Skill 机制发现 |
| Codex | 支持(需适配) | INSTALL.md 明确列出 Codex CLI 路径:向 AGENTS.md 写入带标记的指针块,技能以 Markdown 工作流形式被引用执行 |
| OpenClaw | 未验证 | 仓库未单独列出 OpenClaw 步骤,仅笼统声明“任何能读 Markdown、能跑 shell 的 Agent”均适用,未见专门验证 |
| Hermes Agent | 未验证 | 同上,无专门适配说明 |
5. 推荐理由
把分布式系统测试这一高门槛领域的经验封装成可被编码 Agent 直接执行的结构化流程,让工程师无需深厚背景也能产出经得起审查的测试计划与发现报告。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 6 | GitHub 223 stars(200–1k 区间),且有外部用户在 issue 中主动分享方法论的二次应用案例、外部贡献者提交过修复 PR |
| 可用性 | 9 | 提供幂等安装脚本,按 Agent 类型自动选择挂载方式;README/INSTALL/USAGE 文档齐全并附示例;最近一次提交为 2026-07-21,维护活跃;无付费依赖 |
| 安全性 | 8 | 见下方检查清单 |
安全检查清单:①运行前先发现 SUT 已有工具箱,不凭空构造高权限命令 ②无联网外发,测试针对本地/自建集群 ③无需 API key ④文档均为技术方法论说明,未见提示注入迹象 ⑤作者账号自 2011 年活跃、任职 PingCAP,无刷星迹象 ⑥License MIT,明确 ⑦最近提交 2026-07-21,活跃维护
7. 跟同类 Skills 相比的优势
| Skill | 定位 | 与本技能的差异 |
|---|---|---|
| Property_Based_Testing(Trail of Bits) | 通用属性测试方法论,帮助生成能揭示边界条件的随机化测试用例 | 面向任意代码库的通用正确性测试,不特别处理网络分区、多副本一致性等分布式故障模式,也不产出责任归属分类 |
| Test_Driven_Development(Addy Osmani) | 面向日常功能开发的测试驱动开发工作流(红-绿-重构) | 关注单元/功能级别的增量开发节奏,不涉及故障注入、一致性 checker、分布式场景覆盖论证 |
差异化在于专攻分布式与有状态系统:把故障注入、一致性模型校验、覆盖充分性论证打包成完整方法论,该细分方向目前暂无同类竞品。
8. 用户评价
该技能目前在第三方平台尚无具名用户评价。GitHub issue 区有外部用户(SiliconPsycheLabs)讨论将该方法论迁移到 agentic 行为监控场景,另有外部贡献者(theimpostor)提交并合并过一个 bug 修复 PR。
9. 其他补充
参考资料库(references/)含边界隔离、崩溃恢复升级、确定性模拟、TLA+、模糊测试等 8 篇专题文档及 16 项常见坑清单,可作独立知识库查阅。
10. 安装使用方式
Claude Code:
SKILLS_DIR=~/.local/share/distributed-testing-skills
git clone https://github.com/shenli/distributed-system-testing.git "$SKILLS_DIR"
mkdir -p ~/.claude/skills
for skill_path in "$SKILLS_DIR"/skills/*/; do
skill_name=$(basename "$skill_path")
ln -snf "$skill_path" "$HOME/.claude/skills/$skill_name"
done
Codex CLI / 其他 Agent:按 INSTALL.md 指引,把指针块写入 ~/AGENTS.md,指向两个 SKILL.md 路径。
安装后无需重启,对话中提出“设计一份分布式系统测试计划”即可触发;命令可重复执行用于更新(脚本自带幂等 git pull)。
11. 注意事项
- 执行技能会实际运行故障注入脚本,建议在测试环境或可复现的本地集群使用,避免对生产环境做破坏性注入
- 仅 Claude Code、Codex 有明确安装路径,OpenClaw、Hermes Agent 需自行验证兼容性
- 仓库无正式版本号,需通过 git commit 追踪