一、基本信息
| 项目 | 内容 | 数据来源 |
|---|---|---|
| 正式名称 | firecrawl-cli | GitHub 仓库名 firecrawl/cli;因裸仓库名 cli 无区分度,采用 npm 包与官方博客统一使用的 firecrawl-cli |
| 作者/维护者 | Firecrawl(网页数据抓取服务商,firecrawl.dev) | 官方仓库 README / package.json |
| 来源链接 | https://github.com/firecrawl/cli | — |
| 许可证 | ISC | package.json 声明,并经 npm registry 交叉核实;仓库页面未见独立 LICENSE 文件(轻微疏漏) |
| GitHub Stars / Forks | 约 523 / 75 | GitHub 仓库页面读取;当日 GitHub API 部分端点持续故障(GitHub 官方状态页确认为进行中事故),未能做第二独立来源交叉验证,置信度:中 |
| 最新版本 | v1.19.26(约 2026-07-11 发布) | 官方仓库页面 + npm registry 交叉核实 |
| 安装方式 | npm install -g firecrawl-cli;或一键脚本 curl -fsSL https://firecrawl.dev/install.sh | bash;或 npx -y firecrawl-cli init -y --browser |
官方 README |
二、功能介绍与亮点
Firecrawl CLI 把网页搜索、抓取、爬取能力打包成一个 Agent Skill,让 Claude Code 等 Agent 无需额外配置即可自主访问真实网页:
- 搜索:网页/新闻/图片搜索,可选自动抓取结果正文
- 抓取(scrape):任意网页转干净 Markdown,自动处理 JS 渲染
- 爬取(crawl)/ 站点地图(map):批量提取整站内容或列出全部 URL
- 交互(interact):用自然语言操作网页(点击、填表、读取动态内容)
- 监控(monitor):定期检查页面变化
亮点:结果统一写入本地文件而非直接塞进上下文窗口,减少 Agent 上下文消耗;interact 的代码执行发生在 Firecrawl 托管的一次性隔离云端浏览器容器中,而非用户本机,降低本地风险;官方声明的兼容 Agent 列表同时覆盖 Claude Code、Codex、OpenClaw、Hermes Agent 四大生态。
三、适用场景
固定分类:集成与工作流自动化
面向需要让 Agent 获取“当前网页真实信息”的初中级用户:查竞品官网/文档、抓取最新 API 说明防止 Agent 凭旧知识编造用法、批量收集调研资料、监控目标页面更新等。适合技术调研、竞品分析、内容运营等场景的个人开发者与小团队。
四、跨 Agent 兼容性
| Agent | 结论 | 依据 |
|---|---|---|
| Claude Code | 原生支持 | 官方 README 明确列入支持列表,init 命令会自动检测并安装 |
| Codex | 原生支持 | 同上,官方支持列表明确列出 |
| OpenClaw | 原生支持 | 同上,官方支持列表明确列出 |
| Hermes Agent | 原生支持 | 同上,官方支持列表明确列出 |
以上结论均基于官方文档自述的支持列表,未逐一在四个 Agent 环境中亲自安装验证;官方列表另包含 Cursor、Windsurf、OpenCode、OpenHands,超出本报告覆盖的四个生态,仅供参考。
五、推荐理由
一条命令给 Claude Code 等四大 Agent 装上网页搜索抓取与爬取能力,结果落盘不占上下文,interact 代码执行隔离在云端一次性容器中,是目前“让 Agent 联网获取真实网页信息”这一常见需求里,官方维护活跃、四大生态兼容性说明最完整的方案。
六、评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 6 | 独立仓库自身 523 星,处于 200–1k 星区间;公开渠道所见多为第三方 Skill 目录站的收录页,未见独立编辑型讨论佐证更高热度 |
| 可用性 | 8 | 一条命令/脚本即可安装,官方一键检测并写入所有已装 Agent;免费额度 1000 credits/月且无需信用卡,另支持完全免费的自托管;文档完整但个别示例版本号(1.19.6)落后于实际最新版(1.19.26) |
| 安全性 | 8 | 见下方安全检查清单 |
| 综合评分 | 7.3 | 三项均值((6+8+8)/3 ≈ 7.33) |
安全检查清单:
| 检查项 | 结果 |
|---|---|
| ① Shell/代码执行范围 | 本地 CLI 命令范围明确(搜索/抓取/爬取等);interact 支持的 Node/Python/Bash 代码执行发生在 Firecrawl 云端一次性隔离容器中,非本机执行 |
| ② 联网外发 | 核心功能即需将目标 URL / 抓取内容传输至 Firecrawl 云端 API,属功能本身透明必需,非隐蔽外发 |
| ③ API Key/凭据 | 需 Firecrawl API Key,支持浏览器登录或环境变量 FIRECRAWL_API_KEY,firecrawl view-config 可查看存储位置;自托管可完全绕过云端鉴权 |
| ④ 可疑指令排查 | 已核对官方 README 及 skills 目录下 10 个 SKILL.md 文件的公开描述,未见 prompt injection 或越权操作迹象 |
| ⑤ 作者信誉 | Firecrawl 为有独立产品站与多语言 SDK 文档的商业公司,具体融资/团队背景未逐一核实 |
| ⑥ License | ISC(package.json 声明并经 npm registry 交叉核实),仓库页面缺独立 LICENSE 文件,轻微不规范但不构成权属歧义 |
| ⑦ 最近维护 | 最新版本发布于约一周前(2026-07-11),迭代频繁 |
七、跟同类 Skills 相比的优势
| 对比对象 | 定位 | 差异 |
|---|---|---|
| playwright-mcp(microsoft) | 交互式浏览器自动化/测试 MCP | 面向“操作网页完成测试”,需维持浏览器会话;本 skill 面向“批量拿到干净内容”,无需管理浏览器生命周期 |
| context7(upstash) | 实时注入版本精确的第三方库文档 | 仅覆盖其自身索引内的库文档,范围窄而准;本 skill 面向任意网页,覆盖面更广但无库版本精确匹配的保证 |
| openai/plugins 目录下 temporal、gmail 等连接器 | 官方集成目录里的第三方服务连接器 | 对应子目录均未见 README 等说明材料,安装步骤与维护状态无法核实;相比之下本 skill 文档完整、安装步骤清晰、版本更新记录可查 |
选型建议:只需要“让 Agent 看到真实网页内容”,本 skill 开箱即用;若已在做浏览器 UI 自动化测试,playwright-mcp 更贴合;若只需精确的库 API 文档,context7 更轻量。
八、用户评价
该技能目前在第三方平台尚无来源可验证的独立用户评价:Reddit 与 Hacker News 均未见相关讨论帖,公开渠道所见内容以 Firecrawl 官方博客与若干第三方 Skill 目录收录页为主。
九、其他补充
官方仓库同时维护 firecrawl/skills(面向“在应用代码里调用 Firecrawl API”的场景,含 Node/Python/Rust/Java/Elixir 等多语言集成文档)与 firecrawl/firecrawl-claude-plugin(166 星,早期 Claude Code 专属插件形态)两个关联仓库,定位与本 skill(面向“Agent 自主使用终端做网页任务”)不同。
十、安装使用方式
# 方式一:npm 全局安装
npm install -g firecrawl-cli
# 方式二:一键安装脚本
curl -fsSL https://firecrawl.dev/install.sh | bash
# 方式三:npx 免安装初始化(自动检测并写入本机已装 Agent)
npx -y firecrawl-cli init -y --browser
安装后注意事项:首次使用需完成鉴权(浏览器登录或手动填入 FIRECRAWL_API_KEY);init 命令会自动写入检测到的 Agent 配置,通常无需手动重启,个别 Agent 可能需要重新加载插件/技能列表;免费额度每月 1000 credits,超额需升级付费计划或改用自托管版本;如需完全避免云端数据经手,可部署自托管 Firecrawl 实例并通过 --api-key/自定义 endpoint 指向自建服务。
十一、注意事项
- 抓取/搜索/
interact均需将目标 URL 或页面内容发送至 Firecrawl 云端处理,对数据出境有顾虑的场景建议评估自托管方案 - 免费额度有限(1000 credits/月),中大规模爬取需付费
- 仓库缺少独立 LICENSE 文件,虽 package.json 声明为 ISC,追求权属文件齐全的团队可留意
- 本报告的 GitHub Stars 数据因当日 GitHub API 故障未能交叉验证,仅供参考