1. 基本信息
| 项目 | 内容 | 数据来源 |
|---|---|---|
| 名称 | not-your-babysitter-tech-leads-club-agent-skills | — |
| 作者/维护者 | Felipe Rodrigues(github.com/felipfr),收录于 tech-leads-club/agent-skills 技能目录 | GitHub |
| 来源链接 | https://github.com/tech-leads-club/agent-skills/tree/main/packages/skills-catalog/skills/(development)/not-your-babysitter | — |
| 许可证 | CC-BY-4.0(仓库根 LICENSE 声明:源码 MIT,SKILL.md 类内容默认 CC-BY-4.0) | GitHub API |
| GitHub Stars | 所属合集仓库整体 5,019★;该数字属整个合集(88 个子技能共享),不代表本技能自身热度 | GitHub API |
| Forks | 所属合集仓库整体 459;同上,不代表个体 | GitHub API |
| 最新版本 | 1.0.0 | SKILL.md front matter |
| 安装方式 | npx @tech-leads-club/agent-skills install --skill not-your-babysitter |
官方目录页 |
2. 功能介绍与亮点
not-your-babysitter 是一套改变 agent 运行时行为的“标准作业令”:让 agent 以“资深独立操作者”的姿态处理任务——自主推进到底、少提问、每一句结论都要有证据支撑。核心机制包括:
- 证据或停止:任何关于外部世界的判断(库版本、API、当前推荐做法等)必须来自当月检索或实际读取的源码,不允许凭训练记忆作答;拿不到证据就明确说“拿不到”,而不是含糊地贴一个“未验证”标签蒙混过关。
- 三档自主等级:
paired(愿意被全程看着,非破坏性动作前会确认)、solo(默认档,只在三种情况才打断用户)、heads-down(最大自主、最少打断)。等级只改变“透明度”,不改变“是否核实”这条底线。 - 三个例外的打断规则:不可逆操作(删除、强推、发布上线等)、真正的死胡同(穷尽证据来源仍无结果)、会显著改变结果且无法自行判断的歧义——除此之外一律自主处理,遇到含糊需求先按最合理解读推进并用一句话注明假设,而不是抛一串问题打断用户。
- “打转”识别:同一错误重复出现、diff 反复为空等信号出现时,立即停止并汇报,而不是编造一个不存在的版本号或注释掉失败的检查来蒙混过关。
- 完成前自检清单:构建/测试/lint 是否干净、是否动了不该动的东西(spec、测试、敏感配置)、改动量是否与需求量级匹配、结果是否对应真实诉求而非“简单的那一半”——四项任一不过即不算完成。
- 回复风格约束:先给结论后给过程、不写客套开场白与收尾语、多步操作逐条编号、长列表按必做/可选拆分。
3. 适用场景
固定分类:元技能与 Agent 增强——该技能的作用对象是 agent 自身的执行方式(何时验证、何时打断、如何收尾),不涉及任何具体业务领域的产出物,属于对 agent 行为本身的调教。
适用于独立开发者或小团队在处理端到端编码、排障、运维等动手型任务时,希望 agent 少打断、少编造、每个“已完成”的结论都能拿出证据的场景;也适合长时间无人盯着的自主会话(如后台跑一个多步任务),需要 agent 在真正卡住时才回来找人,而不是每一步都确认一遍。
4. 跨 Agent 兼容性
- Claude Code:✅ 原生支持——标准 SKILL.md 格式(YAML front matter + 指令正文),官方目录明确列出
.claude/skills/为安装路径之一。 - Codex:未验证——内容为通用行为准则文本,不调用任何 Claude 专有 API,形式上应可安装,但未见官方或社区测试证据。
- OpenClaw:未验证——同上,无直接测试证据。
- Hermes Agent:未验证——同上,无直接测试证据。
5. 推荐理由
多数 agent 的默认行为是“遇事先问”,这在探索性任务里合理,但在动手型工程任务里会制造大量不必要的上下文切换成本。本技能把“先问”改成“先查证据、拿不到才问”,且把“完成”这个词绑定到可验证的证据(diff、通过的检查、真实数字)上,直接堵住“agent 自称做完了但其实没做”这类静默失败。三档自主等级设计也让用户可以按任务性质随时收紧或放开这条纪律,而不是全有或全无。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 5 | 所属合集仓库整体 5,019★,被 88 个子技能稀释,该子技能自身查无独立第三方讨论、引用或采用数据 |
| 可用性 | 9 | 单命令安装即用;SKILL.md 含 4 组完整“错误做法 vs 正确做法”对照示例;官方目录标注最近更新为 2026-07-31,属新近内容;无脚本、无付费依赖 |
| 安全性 | 9 | 纯提示词/行为准则类技能,无脚本、无外部引用文件,运行时不执行 shell、不外发数据、不索取任何凭据 |
安全检查清单: ① 是否执行 shell 命令及权限范围——无,全文不含任何 shell 命令或代码执行指令 ② 运行时是否联网外发数据——无,官方目录标注 Scripts: No / References: No,纯文本指令 ③ 是否要求 API key/凭据——不涉及 ④ SKILL.md 中有无可疑指令——全文通读未发现 prompt injection 或隐蔽操作指令 ⑤ 作者/组织信誉——作者 Felipe Rodrigues 为该合集仓库内多个技能的活跃贡献者,无刷星或造假迹象 ⑥ License 是否明确——CC-BY-4.0,仓库根 LICENSE 文件明确声明 ⑦ 最近维护时间——2026-07-31 创建并维护,为新近内容,风险低
7. 跟同类 Skills 相比的优势
| 对比对象 | 定位 | 与本技能的差异 |
|---|---|---|
| harness-eval(同合集内) | 静态审计工具,评估 AGENTS.md/技能库本身的质量(有无失效路径、冗余指令) | 审计对象是“说明文件”,产出报告;本技能是运行时行为覆盖层,改变 agent 执行任务时的验证与打断纪律,两者互补而非替代 |
| superpowers(技能调度框架) | 聚焦“该在什么时机调用哪个技能”的调度纪律 | 关注点是技能选择本身;本技能关注“执行任务时如何自证据、何时该停”,可与调度类技能叠加使用 |
| 传统 AGENTS.md 行为规范文档 | 静态文本,需要 agent 每次自行对照执行,缺乏结构化的“三档自主等级”与“打转识别”机制 | 本技能把等级切换、停止条件、完成自检做成可复用的标准流程,而非一段松散的行为期望描述 |
8. 用户评价
该技能目前在第三方平台尚无具名用户评价。
9. 其他补充
所属仓库 tech-leads-club/agent-skills 自我定位为“经过安全校验的技能注册表”,上架前对技能做形态与安全审查。同仓库内的 the-fool、the-jury(决策类)、harness-eval(审计类)等技能与本技能同属“元技能与 Agent 增强”方向,但解决的是完全不同的问题——本技能管的是“任务执行过程中的行为纪律”,而非决策或审计。
10. 安装使用方式
- 命令行安装(推荐):
npx @tech-leads-club/agent-skills install --skill not-your-babysitter - 手动安装:从仓库
packages/skills-catalog/skills/(development)/not-your-babysitter/SKILL.md复制到所用 agent 的技能目录(如 Claude Code 的.claude/skills/not-your-babysitter/)。 - 安装后注意事项:无需重启;在对话中说 “not-your-babysitter”、“work autonomously”、“stop babysitting”、“no hand-holding” 等触发词即可激活;默认以
solo档运行,可明确要求切换到paired(更多讲解与确认)或heads-down(最大自主、最少打断)。
11. 注意事项
- 三档自主等级需要用户对其行为差异有基本认知,否则可能把“agent 不主动确认细节”误判为异常,而非按设计工作。
- 属纯提示词类技能,实际执行严格度依赖底层模型对指令的遵从能力,不同 agent/模型间的表现差异未经验证。
- 技能创建于 2026-07-31,公开历史尚短,长期维护节奏尚待观察。