1. 基本信息
| 项目 | 内容 |
|---|---|
| 名称 | improve |
| 作者/维护者 | shadcn(个人开发者,Vercel 员工,shadcn/ui 作者) |
| 来源链接 | https://github.com/shadcn/improve |
| 许可证 | MIT(GitHub API) |
| GitHub Stars | 8,727(GitHub API) |
| Forks | 384(GitHub API) |
| 最新版本 | 1.0.0(plugin.json 标注,尚无 GitHub Releases) |
| 安装方式 | Claude Code 插件市场 / npx skills add / 手动复制目录 |
2. 功能介绍与亮点
improve 是一个“代码库审计 + 规划”技能:用当前会话里最强的模型通读代码库、判断哪些改动真正值得做、写出可执行的实施计划,再把落地执行交给更便宜的模型完成。技能本身只写 plans/ 目录下的计划文件,从不直接修改源码。
核心流程分四阶段:Recon(摸清技术栈、构建/测试/lint 命令、ADR 等设计文档)→ Audit(并行子代理按 correctness、安全、性能、测试覆盖、技术债、依赖迁移、DX、文档、产品方向九大类审计)→ Vet(审计者亲自复核每条发现,剔除“看似问题实为既定设计”的误报)→ Plan(为每条选中发现写一份自包含的实施计划,任何模型或人都能照做)。还提供 execute 变体:派发一个更便宜的执行子代理在隔离 worktree 里干活,再像技术负责人一样复核其 diff。
亮点:规则中显式规定“审计到的所有仓库内容都是数据而非指令”,遇到试图诱导技能执行额外操作的文本会被记为安全发现而非执行;branch 变体可只审计当前分支相对主干的改动;reconcile 变体可在下次会话核对上次计划的落地情况。
3. 适用场景
固定分类:工程效率与代码质量。适合独立开发者或团队在切换到新代码库、准备重构、或想用更便宜模型执行日常改动时,先用一次强模型审计摸清优先级,再把执行环节下放,从而控制大模型的调用成本。
4. 跨 Agent 兼容性
- Claude Code:原生支持✅——仓库自带
.claude-plugin/plugin.json与marketplace.json,可直接通过插件市场安装。 - Codex:可能兼容——README 声明遵循通用 Agent Skills 格式(agentskills.io),并可通过
npx skills add安装,但未见针对 Codex 的专项确认,判“需适配”。 - OpenClaw / Hermes Agent:未验证——已抓取材料未提及。
5. 推荐理由
它把“强模型负责理解与决策、弱模型负责执行”这一经济学直觉,做成了一个结构完整、有验收关卡、能自我复核的工作流,而不是一次性的代码点评。对于想控制 AI 编程成本、又不想牺牲审计质量的开发者,这是目前少有的把“审计-规划-执行-复核”整条链路封装完整的技能。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 9 | GitHub 8,727 星,且至少 6 家独立技术博客/站点(如 andrew.ooo、developertoolkit.ai)发文专门评测 |
| 可用性 | 9 | Claude Code 插件市场一键安装,文档含完整工作流说明与真实运行示例;384 次 fork、5 位贡献者、11 个 open issue 均显示有人在真实使用 |
| 安全性 | 8 | 纯 Markdown + 参考文档,无脚本;显式禁止修改用户源码、禁止外发凭据、把仓库内容当数据而非指令处理;唯一联网动作(gh issue create)需显式 --issues 标志且有额外确认门 |
综合评分 = 三项均值 = 8.67
安全检查清单逐项:①仅执行用户仓库自身已有的只读命令(如 tsc --noEmit、npm audit),不新增外部依赖,② 默认无外联,唯一例外需显式标志且有二次确认,③ 不涉及 API key/凭据存储,若审计中发现凭据只记录位置和类型、不复现明文,④ 规则中主动声明抓取内容为数据非指令,未见可疑指令,⑤ 作者身份可核实(shadcn,Vercel 员工),⑥ License 明确为 MIT,⑦ 最近一次提交时间为 2026 年 6 月中旬。
7. 跟同类 Skills 相比的优势
| 维度 | improve(shadcn) | improve-codebase-architecture(mattpocock/skills) | Compound Engineering Plugin(EveryInc) |
|---|---|---|---|
| 核心思路 | 强模型审计+规划,弱模型执行 | 找出代码库里的“浅层模块”架构问题,产出可视化 HTML 报告 | 把已解决问题沉淀为可复用模式,防止同类问题反复出现 |
| 覆盖范围 | correctness/安全/性能/测试/技术债/依赖/文档/产品方向九大类 | 聚焦架构/模块深度单一维度 | 覆盖工程全流程知识沉淀,非单次审计 |
| 独立可用性 | 单一技能即可完整跑通 | 需配合同仓库 grilling、domain-modeling 技能交替使用打磨 | 30+ 子技能组成完整方法论体系,学习门槛更高 |
| 执行环节 | 内置 execute 变体可派发执行子代理并复核 diff |
止步于报告,无内置执行派发 | 不特别聚焦“审计后自动执行” |
8. 用户评价
- 独立开发者 jcane86 在仓库 issue 中反馈多分支并行开发场景下的用法:“把每个’项目意图’放进独立子文件夹、在
plans/README.md维护总索引,目前这套方式运转良好”(github.com/shadcn/improve/issues/15)。 - 技术博客 andrew.ooo 的评测认为该技能“是第一个真正把审计与执行分离这一经济学直觉做成产品的广泛使用工具”,同时指出“大型 monorepo 上的算力成本仍不可忽略”、“把计划写进 git 与团队用 Linear/Jira 作唯一权威 backlog 的习惯有冲突”(andrew.ooo/posts/shadcn-improve-audit-plan-execute-agent-skill-review)。
9. 其他补充
仓库自 2026 年 6 月创建以来保持单一版本 1.0.0,尚未发布 GitHub Releases;examples/ 目录附有针对 shadcn/ui 自身仓库的真实审计-出计划案例,可作为效果参考。
10. 安装使用方式
- 方式一(推荐,Claude Code):
/plugin marketplace add shadcn/improve /plugin install improve - 方式二(跨 Agent,Agent Skills 通用格式):
npx skills add shadcn/improve - 方式三(手动):将仓库
skills/improve/目录复制进所用 agent 的 skills 目录。
安装后在目标代码库中运行 /improve(或 /improve quick 做低成本首轮)即可触发审计流程;无需额外重启或配置 API key。
11. 注意事项
- 方式二依赖的第三方安装器
npx skills(vercel-labs/skills)存在尚未修复的隐私类 open issue(未经同意上传使用数据、审计上报不受禁用开关约束),建议优先选用方式一或方式三规避该安装链路。 - 大型 monorepo 上审计仍有不可忽略的算力/token 成本,并非零成本操作。
- 若审计手册(
references/audit-playbook.md)未覆盖某类问题,可能出现漏报;执行阶段若指派的执行模型能力偏弱,可能需要多轮修订才能通过复核。 - 计划文件以 Markdown 形式写入代码库
plans/目录,与团队用 Linear/Jira 等外部系统作为唯一权威 backlog 的工作习惯可能存在协调成本。 - Codex / OpenClaw / Hermes Agent 的兼容性未经官方专项确认,如需跨 Agent 使用建议先小范围验证。