一、基本信息
| 项目 | 内容 | 数据来源 |
|---|---|---|
| 正式名称 | dev-browser | 独立仓库,仓库名即正式名称 |
| 作者/维护者 | Sawyer Hood(SawyerHood,独立开发者) | GitHub |
| 来源链接 | https://github.com/SawyerHood/dev-browser | — |
| 许可证 | MIT | GitHub API |
| GitHub Stars / Forks | 6,437 / 418 | GitHub API |
| 最新版本 | v0.2.9(2026-07-15 发布) | GitHub Releases API |
| 安装方式 | Claude Code 插件市场一条命令,或 npm install -g dev-browser 独立 CLI(见第十章) |
官方 README / SKILL.md |
二、功能介绍与亮点
dev-browser 让 Claude Code 通过沙盒化 JavaScript 脚本直接操控真实 Chrome 浏览器,专为“agent 自己动手验证前端改动”设计。
核心能力:
- ARIA Snapshot:把页面原始 HTML 转成结构化 YAML,剔除 CSS 与脚本噪音,减轻大模型解析页面结构的负担
- Ref 系统:用元素引用代替截图定位可点击元素,相比纯视觉方案显著减少误点击
- 脚本批处理:一条脚本内串联多个浏览器动作,避免与传统 MCP 浏览器工具那种“一步一次工具调用”的乒乓式交互
- 持久化页面状态:命名的 daemon 浏览器默认保留登录态与标签页状态,可用
--idle-timeout控制闲置自动回收 - 沙盒执行:脚本运行在 QuickJS WASM 沙盒中,无宿主机文件系统/网络直接访问权限,文件 I/O 被限制在
~/.dev-browser/tmp/
亮点:独立第三方实测显示,在相同任务上比 Claude Code 原生 --chrome 功能快约 2 倍;作者 Sawyer Hood 是知名独立开发者(val.town 创始人);仓库创建仅 7 个多月即获 6,400+ star,且发版活跃(最近一个版本发布于 2026-07-15)。
三、适用场景
固定分类:工程效率与代码质量
适用于:前端开发调试时让 agent 自动打开页面、点击、填表、截图验证 UI 改动是否生效;Web 应用端到端测试;网页数据抓取;需要 agent 自主“跑一遍再确认”的自动化浏览器工作流。受益人群:前端/全栈开发者、需要 agent 自主验证自己写的界面改动的用户、做轻量网页自动化的开发者。
四、跨 Agent 兼容性
| Agent | 结论 | 依据 |
|---|---|---|
| Claude Code | 原生支持 | 官方提供 Claude Code 插件市场一条命令安装路径,SKILL.md 含标准触发短语(“go to url”“take a screenshot”等) |
| Codex | 未验证 | 已抓取材料未提及 Codex 专门支持;本质是 npm 全局 CLI,理论上任何能执行 shell 命令的 agent 均可调用,但 SKILL.md 自动触发机制是 Claude Code 专属,未为此单独搜索 |
| OpenClaw | 未验证 | 同上,已抓取材料未提及 |
| Hermes Agent | 未验证 | 同上,已抓取材料未提及 |
五、推荐理由
Web 前端开发中最耗时的环节之一是“改完代码后人工点开浏览器验证”,dev-browser 把这一步交还给 agent 自己:沙盒化脚本 + ARIA Snapshot + 批处理指令的组合,让 Claude Code 能高效、低误触地操控真实浏览器完成点击、填表、截图、断言,并有独立测评验证其比官方原生方案快约一倍。对初中级用户而言,安装只需一条命令,无需任何 API Key,且沙盒隔离让“给 agent 浏览器权限”这件事不必担心波及本机文件系统。
六、评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 9 | 6,437 stars,独立开发者出品但社区认可度高,有独立第三方博主实测验证 |
| 可用性 | 9 | 一条命令安装,SKILL.md/README 含完整触发短语与示例,7 天内有新版本发布,无付费依赖 |
| 安全性 | 9 | 见下方安全检查清单 |
| 综合评分 | 9.0 | 三项均值 |
安全检查清单:
| 检查项 | 结果 |
|---|---|
| ① Shell 命令执行及权限范围 | 有——通过 CLI 触发浏览器操作,但用户脚本本身运行在 QuickJS WASM 沙盒内,无宿主机文件系统/网络直接访问,文件 I/O 限制在 ~/.dev-browser/tmp/ |
| ② 运行时联网外发数据 | 有——浏览器本身会发起正常网页请求,这是“操控浏览器”这一功能的必然行为,非隐蔽外发 |
| ③ API Key/凭据要求及存储方式 | 无需任何凭据,安装与运行均不要求 API Key |
| ④ 可疑指令/Prompt Injection 迹象 | 未发现——README 与 SKILL.md 均为常规技术说明,无越权指令 |
| ⑤ 作者/组织信誉 | Sawyer Hood,真实身份公开,知名独立开发者(val.town 创始人),4 位贡献者共同维护 |
| ⑥ License 是否明确 | MIT,明确 |
| ⑦ 最近维护时间 | 最新版本 v0.2.9 发布于 2026-07-15,维护活跃 |
七、跟同类 Skills 相比的优势
| 维度 | dev-browser(本次推荐) | playwright-skill(lackeyjb) | 通用 Playwright MCP 服务器方案 |
|---|---|---|---|
| Stars | 6,437 | 2,916 | 因方案而异,无统一仓库 |
| 执行方式 | 沙盒 QuickJS 脚本,批量指令一次执行 | Claude 现场编写并执行 Playwright 代码 | agent 与 MCP 服务器多轮工具调用 |
| 页面感知 | ARIA Snapshot 转结构化 YAML + Ref 系统定位元素 | 依赖 Claude 自行编写选择器 | 通常依赖截图或原始 DOM |
| 隔离性 | 沙盒内无宿主机直接访问权限 | 无额外沙盒层,依赖 Claude 生成代码的正确性 | 视具体 MCP 实现而定 |
| 实测性能 | 独立博主实测比 Claude 原生 --chrome 快约 2 倍 |
未见独立性能对比 | 多轮工具调用通常慢于批处理方案 |
dev-browser 相对 lackeyjb/playwright-skill 的核心差异在于“结构化感知 + 沙盒隔离 + 批处理”三者叠加:前者把页面转成 LLM 更易处理的 YAML 快照并用引用而非坐标定位元素,减少误点击;后者更接近“把 Playwright 原始能力开放给 Claude 自由发挥”,灵活但更依赖 Claude 临场编写代码的准确性。相对通用 MCP 浏览器方案,dev-browser 的批处理指令减少了逐步工具调用的往返延迟。
八、用户评价
- Peerasak Unsakon(独立开发者博客 peerasak.com,dev-browser 介绍与实测):亲自测试后确认其比 Claude Code 原生
--chrome功能快约 2 倍完成相同任务,认为该技能“优雅地把 prompt engineering 与软件工程结合”,安装体验“比 MCP 服务器更即插即用”;同时指出对一般用户而言 Claude 原生--chrome仍然够用,dev-browser 更适合需要高频、高效浏览器操作的多技能 agent 场景。
(公开渠道目前仅见这一条来源可查的独立评价。)
九、其他补充
dev-browser 依赖 playwright、playwright-core、quickjs-emscripten 三个开源库;仓库创建于 2025-12-02,7 个多月内迭代至 v0.2.9,由 4 位贡献者共同维护(Sawyer Hood 本人贡献占绝大多数)。
十、安装使用方式
方式一:Claude Code 插件市场(推荐)
/plugin marketplace add sawyerhood/dev-browser
/plugin install dev-browser@sawyerhood/dev-browser
方式二:npm 全局安装(独立 CLI,适合手动接入其他 agent 或脚本)
npm install -g dev-browser
dev-browser install
安装后注意事项:需要本机已安装 Node.js 与 Chrome 浏览器;首次使用建议运行 dev-browser --help 查看完整用法与 API 参考;可通过 --idle-timeout 5m 控制浏览器闲置自动关闭的时间,设为 --idle-timeout 0 可禁用自动清理以长期保留登录态。
十一、注意事项
- 若选择让 dev-browser 连接“用户日常使用中的真实 Chrome”(remote debugging 模式),理论上可能暴露该浏览器已登录的会话;建议优先使用工具默认新建的独立 daemon 浏览器,而非接管个人日常 Chrome 实例
- 任何驱动真实浏览器的 agent 工具都存在“网页内容间接提示词注入”这一类通用风险——恶意网页可能在内容中嵌入试图操纵 agent 的文字,这是此类工具的固有风险而非该 skill 独有缺陷,执行提交表单、发送内容等高敏感操作时仍建议保留人工复核
- Codex、OpenClaw、Hermes Agent 的兼容性未在已抓取材料中得到证实,标记为“未验证”
- 目前由 Sawyer Hood 个人主导维护,尚无多维护者的治理结构,需自行评估长期维护连续性风险