1. 基本信息
| 项目 | 内容 |
|---|---|
| 名称 | datalineage-summary-google-skills |
| 项目自述名称 | Data Lineage Summary |
| 作者/维护者 | Google(google/skills 官方仓库) |
| 来源链接 | https://github.com/google/skills/tree/main/skills/cloud/datalineage-summary |
| 许可证 | Apache-2.0(数据来自 GitHub API) |
| GitHub Stars | 合集仓库整体 19,804(数据来自 GitHub API;该数字属整个 google/skills 合集,不代表本技能自身热度) |
| Forks | 合集仓库整体 1,593(数据来自 GitHub API) |
| 最新版本 | 无独立版本号,随仓库滚动更新;本技能最近一次相关提交为 2026-07-16(数据来自 GitHub API 提交记录) |
| 安装方式 | npx skills add google/skills,安装时可只勾选本技能;或手动复制 skills/cloud/datalineage-summary 目录 |
2. 功能介绍与亮点
给定一张 BigQuery 表或一个字段,该技能自动向上游、下游发起数据血缘查询,把复杂节点关系折叠成一份从左到右、大白话讲清“数据从哪来、到哪去”的 Markdown 报告。
- 表级、列级血缘均支持,可定位具体字段的流转路径。
- 报告结构固定(流程类型→系统概览→上下游叙述→查询边界),每次输出格式一致。
- Google 官方出品,与 Data Lineage(Knowledge Catalog)产品同源维护,Apache-2.0 开源可审计。
3. 适用场景
固定分类:数据分析与可视化
数据分析师、数据工程师排查数据质量问题(如报表数字异常)时,用它快速理清一张表或字段的来源与去向,无需在 Data Lineage 控制台逐个点开节点;也适用于新人接手数据管道时生成血缘说明用于交接。
4. 跨 Agent 兼容性
- Claude Code:原生支持,配置好 Data Lineage MCP 服务器即可使用。
- OpenClaw:原生支持,采用与 Claude Code 相同的 SKILL.md 标准,原生支持 MCP 工具封装型技能。
- Codex:需适配。默认沙箱不联网,而本技能需联网访问 Google 的 MCP 服务与官方文档,需手动放开出网权限。
- Hermes Agent:未验证,未找到该技能或所属仓库在该生态下的适配信息。
5. 推荐理由
数据血缘排查原本要在控制台里手动展开节点逐条对照,费时且容易漏看跨地域链路;该技能把“发起查询、遍历节点、组织语言”固化成指令,一次执行即可得到结构统一、面向人话的血缘报告,初中级用户无需先学会 Data Lineage 的 API 参数。作为官方技能,其查询深度、地域覆盖等参数设置比较稳妥,降低“血缘查漏”风险。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 7 | Google 官方(Data Lineage 产品所有者)出品;本技能自身暂无独立于合集仓库的第三方热度证据(如具名评价、独立报道) |
| 可用性 | 8 | 需接入 Data Lineage MCP 服务器并配置 GCP 凭据,属“需少量配置”;附独立的 MCP 接入说明文档;最近一次维护在近 6 个月内 |
| 安全性 | 9 | 见下方检查清单 |
安全检查清单:①不执行本地 shell 命令,纯 Markdown 指令 + MCP 工具调用;②通过 MCP 只读查询 Google 官方 Data Lineage 服务、读取 Google 官方文档,外联目标透明;③使用 GCP 官方凭据体系鉴权,无需自建密钥;④未见可疑指令;⑤Google 官方仓库,信誉良好;⑥License Apache-2.0 明确;⑦最近维护 2026-07-16,未被归档。
综合评分 = 三项均值 = 8.0。
7. 跟同类 Skills 相比的优势
| 技能 | 定位 | 与本技能的差异 |
|---|---|---|
| datalineage-bigquery-asset-impact-analysis(google/skills) | 评估数据资产下游被改动会波及哪些系统 | 产出的是风险影响面评估而非血缘全貌讲解,官方说明中二者互相标注适用边界,属互补关系 |
| bigquery-basics(google/skills) | BigQuery 入门查询与建表 | 聚焦日常 SQL 操作,不处理跨系统血缘图谱 |
| trace-file-lineage | 追踪代码仓库内文件的演变谱系 | 面向代码/文件版本溯源,不涉及云端数据资产血缘 |
8. 用户评价
该技能目前在第三方平台尚无具名用户评价,仅见少量镜像型技能安装目录收录了其基本信息。
9. 其他补充
暂无。
10. 安装使用方式
- 通过 CLI:
npx skills add google/skills,安装时选择datalineage-summary。 - 手动安装:克隆
google/skills仓库,复制skills/cloud/datalineage-summary目录到所用 agent 的 skills 目录。 - 使用前需在 agent 的 MCP 配置中加入 Data Lineage MCP 服务器地址,并确保 GCP 凭据具备 Dataplex/Knowledge Catalog 访问权限;安装后无需重启,直接提出血缘排查请求即可触发。
11. 注意事项
- 仅适用于已在 GCP 侧启用血缘采集的 BigQuery / GCS 资产,未开启采集的资产无法生成有效报告。
- 不适用于下游影响半径评估(该场景应使用同仓库的 datalineage-bigquery-asset-impact-analysis)、普通 BigQuery 查询或修改血缘关系本身。
- 需联网访问 Google 官方 MCP 服务与文档,网络受限环境(如部分 Codex 沙箱)下需额外放开出网权限。