1. 基本信息
| 项目 | 内容 |
|---|---|
| 名称 | the-jury-tech-leads-club-agent-skills |
| 作者/维护者 | Felipe Rodrigues(github.com/felipfr),发布于 Tech Leads Club 维护的技能注册库 |
| 来源链接 | https://github.com/tech-leads-club/agent-skills/tree/main/packages/skills-catalog/skills/(decision-making)/the-jury |
| 许可证 | 仓库根 LICENSE 为 MIT;本技能 SKILL.md front matter 另行声明 CC-BY-4.0(数据来源:GitHub API + 直接读取 SKILL.md,两处均明确一致) |
| GitHub Stars | 所属技能注册库整体 5,019(数据来源:GitHub API;该数字属整个合集,不代表本技能自身热度) |
| Forks | 合集仓库整体 459 |
| 最新版本 | SKILL.md 内声明 1.0.0(数据来源:直接读取 SKILL.md) |
| 安装方式 | 官方 CLI 一条命令安装(npx @tech-leads-club/agent-skills) |
2. 功能介绍与亮点
the-jury 让 agent 扮演“陪审团团长”,为一个工程、架构、产品或战略层面的决策召集 3–5 个 subagent 陪审员,跑一套专门对抗从众心理与首因效应设计的流程:先各自盲态独立表态(互不可见),再进入匿名化辩论(隐去身份与人格标签,防止同源模型互相偏袒),任何改票都必须引用具体新论据,否则在裁决阶段被判定为“从众翻票”并回退到第一轮独立投票的结果。团长最后用一个确定性脚本(scripts/tally.py)而非直觉汇总裁决——按置信度加权计票、审计翻票是否有理由、按证据等级(A–D)设置置信度上限,全程不许弃权。
核心亮点:① 方法论有明确依据——SKILL.md 直接引用 2025–2026 年多智能体研究的五条发现(辩论本身不提升正确率、同质面板容易一起犯错、agent 会锚定第一意见等),并把每条发现转成具体的流程约束,而非空泛口号;② 裁决可复现、可审计——tally.py 是一个纯本地 Python 脚本,输入输出结构清晰,任何人都能读懂加权计票与“从众检测”的判定逻辑;③ 强制留痕异见——裁决格式固定要求保留“最强少数派意见”与“最危险假设”,不是简单地报多数票;④ 双语示例(英文工程权衡、葡萄牙语 build-vs-buy)证明其领域无关、语言无关的定位。
3. 适用场景
所属分类:元技能与 Agent 增强
适合需要给一个存在分歧的复杂决策拿到“一个可执行结论”而非“一堆意见”的场景:架构选型(是否迁移存储引擎)、build-vs-buy、技术选型、招聘评估、产品优先级取舍等。目标用户是用 Claude Code 等 agent 处理高风险、多维度权衡且希望结论经过对抗性检验的开发者与技术负责人,尤其是已经习惯用单个 agent 拍板、但发现单一视角容易被自己说服自己的用户。
4. 跨 Agent 兼容性
- Claude Code:原生支持 ✅——官方 CLI 支持列表第一梯队列出 Claude Code,且工作流明确提到“用 Claude Code 的 Task 工具并行生成陪审员”
- Codex:支持 ✅——官方 CLI 支持列表列出 OpenAI Codex
- OpenClaw:未验证——官方支持列表未列出该 agent;SKILL.md 是标准 YAML front matter + Markdown 格式,理论上可手动复制使用,但未找到官方安装适配或第三方验证
- Hermes Agent:未验证——同上,官方支持列表未列出,也未检索到独立于该仓库之外的第三方收录证据
5. 推荐理由
组建独立 subagent 陪审团匿名辩论后给出一个可执行裁决,避免群体决策被从众和锚定带偏——把“多 agent 一起讨论”从容易互相说服的空谈,改造成有具体反从众机制、可审计的决策流程。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 5 | 该技能所属注册库共 88 个 SKILL.md,仓库整体星数不代表本技能自身热度;GitHub 搜索显示本技能自身除最初的添加 PR 外无独立于母仓库之外的讨论或引用 |
| 可用性 | 9 | 官方 CLI 一条命令安装,明确支持 Claude Code / Codex 等十余个平台;SKILL.md + 2 份参考文档(陪审员人格库、审议方法论与 Prompt 模板)+ 1 个确定性计票脚本,共 4 个文件、约 4.4 万字节,含完整双语示例;最近一次提交在近两周内,持续维护;纯文本 + 本地脚本内容,无付费依赖 |
| 安全性 | 8 | 见下方检查清单 |
综合评分:7.33
安全检查清单逐项结果:① Shell 命令/权限范围——仅一个本地 Python 脚本 scripts/tally.py(约 9.8KB),逐行核查确认只做纯计算(加权计票、翻票审计),无子进程调用、无文件写入、无 eval;② 联网外发——未见任何网络请求代码,subagent 陪审员的调用走的是宿主 agent 自身的并行工具机制,非本技能外发数据;③ API key/凭据——不需要;④ 可疑指令——通读 SKILL.md 全文及 tally.py 源码,未发现提示注入或隐蔽指令迹象;⑤ 作者信誉——独立开发者,是该仓库多个技能的活跃作者,仓库声明全部技能发布前经第三方 Snyk Agent Scan 安全扫描;⑥ License——明确,仓库根 MIT + 技能自身 front matter 另行声明 CC-BY-4.0;⑦ 最近维护——2026-07-31 有提交,处于活跃状态。
7. 跟同类 Skills 相比的优势
| 对比对象 | 定位 | 与本技能的差异 |
|---|---|---|
| the-fool(同注册库 tech-leads-club/agent-skills 子技能) | 单一“魔鬼代言人”角色,用苏格拉底诘问、预先验尸、红队等 5 种批判模式挑战一个方案,只提出质疑,不给结论 | the-jury 是它的“决策版兄弟”:不止挑战,还要组建多角色陪审团、走完整审议流程并最终委托团长给出一个带置信度的可执行裁决;两者在 SKILL.md 中互相引用,分工是“质疑”与“决策”而非重复 |
| paperjury(独立仓库 u7079256/paperjury) | 面向计算机领域会议论文投稿的对抗式多轮审稿引擎,评审对象是 LaTeX/Markdown 论文正文,产出是直接改写论证的编辑建议 | 服务场景高度垂直(仅限学术论文投稿),且会直接修改用户的论文内容;the-jury 领域无关(工程、产品、战略均可),且严守“只裁决不动手实现”的边界,不替用户改代码或写方案 |
8. 用户评价
该技能目前在第三方平台尚无独立的具名用户评价。
9. 安装使用方式
方式一:交互式向导
npx @tech-leads-club/agent-skills
方式二:直接安装本技能
npx @tech-leads-club/agent-skills install -s the-jury
(也可全局安装 CLI 后直接用 agent-skills install -s the-jury)
安装后无需重启。技能通过 SKILL.md 的 description 字段自动触发——当对话中出现“convene a jury”“多 agent 决策”“get a panel to decide”等触发语句,或用户明确要求为一个有分歧的决策组建陪审团时会自动激活;也可以直接要求 agent “用 the-jury 帮我裁决一下 X”。
10. 注意事项
- 陪审团人数默认 3、高风险场景建议 5,人数越多并不必然更准——面板同质化(人格雷同、同一底层模型)时其确定性计票脚本会主动给置信度打折
- 该技能是所属注册库 88 个 SKILL.md 之一;仓库整体星数与活跃度不代表本技能自身热度
- OpenClaw 与 Hermes Agent 兼容性未获验证
- 面板越大越消耗 token(默认 3–5 个 subagent 并行运行两轮),不适合用来处理简单的事实性查询