1. 基本信息
| 项目 | 内容 |
|---|---|
| 名称 | AgentSight |
| 作者/维护者 | eunomia-bpf(英国注册的开源组织,自 2022 年起持续运营 eBPF 相关开源项目;主要维护者 yunwei37) |
| 来源链接 | https://github.com/eunomia-bpf/agentsight |
| 许可证 | MIT(GitHub API 确认) |
| GitHub Stars / Forks | 532 / 71(GitHub API 实测) |
| 最新版本 | v0.2.64,发布于 2026-07-20(GitHub API 确认) |
| 安装方式 | cargo install agentsight 或下载预编译二进制;完整实时能力需 Linux 内核 4.1+(5.0+ 更佳) |
2. 功能介绍与亮点
AgentSight 是一个“像 top/strace 一样”的系统级观测工具,专门用来看清编码 agent(Claude Code、Codex 等)在你机器上真实做了什么——它创建了哪些子进程、读写了哪些文件、发起了哪些网络连接。更进一步,它用 eBPF 在 TLS 握手边界截获 agent 与大模型之间的明文调用内容,把“agent 说了什么”和“agent 在系统里实际做了什么”这两条证据流关联起来,而不是只依赖 agent 自己写的、可能不完整的日志。
核心命令覆盖几种典型需求:top(实时会话排名)、record(把指定命令的完整会话录制到本地 SQLite)、vis(把某个代码仓库下的历史会话回放成动画 GIF/HTML)、report(离线查询已录制的会话:token 用量、进程审计、prompt 记录等)、agentpprof(生成 pprof 格式火焰图,定位 token/资源开销热点)。仓库还内置一组配套的 Claude Code Skills,可直接分析上述系统证据、生成“agent 运行摩擦点”报告,并在设计上默认使用隐私模式、避免在报告里暴露本机路径与主机名等敏感标识。
亮点:
- 零代码侵入:不需要给 agent 接 SDK、不需要中间代理,从系统调用与 TLS 层直接观测,对闭源 CLI agent 同样有效
- 有同行评审论文背书:对应研究已收录于 ACM 相关会议论文集,并配有 arXiv 预印本,不是纯营销项目
- 性能开销经过量化:官方评测显示典型 agent 工作负载下 CPU 开销低于 3%
- 支持导出 OpenTelemetry GenAI 格式,可接入已有的可观测性后端
3. 适用场景
所属分类:DevOps 与基础设施
- 编码 agent 执行复杂任务后行为异常、变慢或卡住,需要从系统层面回放它到底调用了哪些子进程、碰了哪些文件、发了哪些网络请求
- 想量化某次 agent 会话的 token 消耗与耗时分布,用来优化 prompt 或工作流
- 对 agent 的系统层操作范围有安全审计需求——确认它没有意外碰不该碰的文件或对外发数据
- 面向个人开发者与小团队:本地跑起来即可,不需要额外的 APM 平台账号
4. 跨 Agent 兼容性
| Agent | 结论 | 依据 |
|---|---|---|
| Claude Code | 原生支持 | 仓库自带 CLAUDE.md,含专门的 skills/ 目录与多个 SKILL.md;README 示例命令 sudo ./agentsight record -- claude |
| Codex | 原生支持 | README「Supported Agents」与 agentpprof 文档明确列出对本地 Codex 会话历史的离线分析支持 |
| OpenClaw | 原生支持 | README「Supported Agents」表格列出 Docker containers (OpenClaw, …),提供专门的 --binary-path docker://openclaw 追踪方式 |
| Hermes Agent | 未验证 | 已抓取材料中未出现相关内容,不作臆测 |
5. 推荐理由
当编码 agent 变得越来越自主,普通开发者却几乎拿不到任何“它到底做了什么”的系统级证据——日志可能是 agent 自己写的,也可能压根没记录。AgentSight 用内核级观测手段绕开了这个信任问题:不管 agent 的日志怎么说,它记录的是操作系统层面真实发生的事,为“要不要放心让 agent 自主跑”这个普遍焦虑提供了一个可验证、可审计的答案。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 6 | GitHub 532 stars / 71 forks(API 实测);对应研究已发表于 ACM 相关会议并配 arXiv 预印本,所属组织自 2022 年起持续运营,但未发现主流技术社区(Reddit/HN 等)的独立讨论帖 |
| 可用性 | 7 | cargo install agentsight 一条命令即可安装;文档体系完整(README + 专门的 docs/ 目录 + FAQ,逐项说明权限需求与性能开销);近期(2026-07-20)仍有新版本发布;但完整实时能力要求 Linux + root,其他平台只能退化为无 eBPF 的会话快照/回放模式 |
| 安全性 | 8 | 见下方安全检查清单 |
综合评分(三项均值):7.0
安全检查清单:
① Shell 命令执行——是,eBPF 探针需要 root 权限做实时系统捕获(sudo),但 FAQ 逐条说明了各模式实际所需权限,并明确“被追踪的 agent 本身仍以普通用户身份运行,只有探针被提权”
② 联网外发——默认不外发,采集到的会话数据以 SQLite 文件形式保存在本地当前目录;仅当用户主动执行 agentsight debug trace --otel 并指定 endpoint 时才会导出到用户自选的可观测性后端,属主动配置行为
③ API Key/凭据——不涉及,工具本身不需要连接任何第三方账户或存储凭据
④ 可疑指令——未发现,skills/ 目录下的 SKILL.md 为系统证据分析指引,且明确写有隐私模式设计(默认不在报告中暴露本机路径、主机名等标识)
⑤ 作者信誉——eunomia-bpf 自 2022 年起持续运营 eBPF 开源项目,对应论文已通过同行评审收录于 ACM 出版物,未发现刷星或 SEO 操纵措辞
⑥ License——MIT,明确
⑦ 维护时间——近期(2026-07-20)仍有新版本发布,持续活跃维护
7. 跟同类 Skills 相比的优势
| Skill/工具 | 定位 | 与 AgentSight 的差异 |
|---|---|---|
| dd-apm(Datadog 官方出品) | 面向已部署生产应用/服务的 APM 监控 | 观测对象是“你上线的应用”,需要在应用里接入 Datadog 探针;AgentSight 观测对象是“正在你电脑上跑的编码 agent 本身”,不需要给 agent 做任何代码级接入 |
| LangSmith / Langfuse / Helicone 等应用层 agent 可观测性工具 | 追踪调用链、prompt、token、评测 | 都要求你拥有应用代码并接入 SDK/回调/网关才能采集数据;AgentSight 从操作系统边界观测,即使 agent 是完全看不到源码的闭源 CLI,也能追踪 |
| grafana-oss(Grafana 官方出品) | 通用指标/日志/追踪可视化后端,需自行接入数据源 | 是通用可视化平台,本身不采集 agent 行为数据;AgentSight 是采集+分析一体化工具,专为“编码 agent 的系统行为”设计,开箱自带 agent 专属视图 |
8. 用户评价
GitHub 用户 AndriyNovykov 在 Ubuntu 远程服务器上实际部署本工具追踪 Claude Code 会话,先后提交了三份详细的技术反馈(如“追踪 Claude Code 时同一进程被识别成多个 PID”“Docker 部署下未捕获到网络流量”等),每份都附带复现步骤、日志与截图,并与维护者展开了十余轮排查讨论。该技能目前公开的具名讨论以仓库自身的 issue 区为主,尚未见到面向大众社区(Reddit、Hacker News 等)的独立评价文章。
9. 其他补充
仓库提供中英双语文档(README.md / README.zh-CN.md)。项目设有在线演示 agentsight.us,可直接在浏览器里查看一段真实录制的 Claude Code 会话回放,无需本地安装即可体验核心效果。
10. 安装使用方式
安装:
cargo install agentsight
# 或下载预编译二进制后:
chmod +x agentsight
常用命令:
agentsight top # 实时会话监控(有 sudo 时自动启用 eBPF)
sudo agentsight record -- claude # 录制一次 Claude Code 会话
agentsight vis # 在 git 仓库目录下,把历史会话回放成动画
agentsight report # 查看最近一次录制的摘要
内置 Claude Code Skills:将仓库 skills/ 目录下对应子文件夹复制到 ~/.claude/skills/,或参照仓库 skills/README.md 所述方式加载。
安装后注意:完整的实时捕获能力(top 的 eBPF 模式、record)需要 Linux 且需 sudo 权限;无 sudo 或非 Linux 环境会自动退化为进程快照 + 本地 agent 会话文件读取模式,功能有所削减但仍可用于会话回放与 token 分析。容器环境部署需保留 eBPF 所需的 host 特权访问,具体见仓库 docs/docker.md。
11. 注意事项
- 完整功能强依赖 Linux 内核 eBPF 能力与 root 权限,macOS 等平台目前只能使用无 eBPF 的会话快照与本地日志回退模式,功能会打折扣
- GIF 格式的会话回放导出需要本机安装 Chromium 和 FFmpeg,否则只能导出功能相同、依赖更少的 HTML 格式
- 项目仍在快速迭代中,近期仓库 issue 显示个别平台适配类问题仍在修复,部署到共享/生产服务器前建议先在个人环境验证
- 工具本身只做观测和分析,不会替你修复 agent 暴露出的问题,后续处理仍需自己动手