1. 基本信息
| 项目 | 内容 | 数据来源 |
|---|---|---|
| 名称 | crm-data-quality-hubspot-agent-cli-skills | — |
| 项目自述名称 | HubSpot Agent CLI Skills(合集仓库自身名) | GitHub README |
| 作者/维护者 | HubSpot(CRM/营销 SaaS 厂商),官方组织仓库 | GitHub API |
| 来源链接 | https://github.com/HubSpot/agent-cli-skills/tree/main/crm-data-quality | — |
| 许可证 | Apache License 2.0 | GitHub API |
| GitHub Stars / Forks | 18 / 7(合集仓库整体口径,含 15 个子技能,不代表本技能个体热度;本技能自身在 skills.sh 上有 883 次独立安装记录,见第 6 章) | GitHub API;skills.sh |
| 最新版本 | 无正式版本标签,持续滚动提交 | GitHub API |
| 安装方式 | npx skills hubspot/agent-cli-skills/crm-data-quality(单装)或 npx skills hubspot/agent-cli-skills(全装 15 个技能) |
官方 README |
2. 功能介绍与亮点
crm-data-quality 教编程 Agent 用官方 hubspot CLI 批量发现并修复 CRM 记录里的脏数据:
- 属性发现先行:不靠猜字段名,先用
hubspot properties list列出全部属性及类型,包括自定义属性组,避免拼错字段名导致过滤或写入落空 - 缺失字段定位:用
!字段名语法定位缺失/空值属性(如缺邮箱、缺电话、无负责人的联系人),支持AND/多重--filter组合出更精确的问题记录集 - 批量归一化:先搜索、用
jq重塑、再写回——如把公司名的多种拼法收敛成统一写法、把邮箱统一转小写,动手前强制--dry-run预览 - 安全合并去重:
hubspot objects merge支持单对合并或整批 JSONL 管道合并;明确提示合并不可逆,并给出恢复路径(hubspot history --since追溯,或从 UI 回收站还原次记录) - 跨页去重陷阱提示:文档特别指出
objects search单次上限 100 条,若不先做完整分页收集就直接对原始流去重,会静默漏掉跨页边界的重复记录——这是容易踩的坑,文档直接写出了正确做法 - 自定义属性审计:按属性组统计字段数量(标准字段 vs 自定义字段一目了然)、列出全部枚举类型属性,并给出新建“数据质量标记字段”的示例,方便持续追踪清理进度
亮点:官方一线 CRM 厂商出品;建立在同仓库 bulk-operations 基础技能之上,复用其安全写入闸门与 JSONL 管道约定;把“跨页去重会静默漏重复”这类隐蔽陷阱直接写进文档,而非留给用户自己踩坑发现。
3. 适用场景
所属分类:集成与工作流自动化
CRM 里积累了缺失字段、拼写不一致或重复联系人/公司记录的团队,想让 Agent 批量定位并清理这些脏数据,而不是逐条在网页端手动核对修改,或自己拼接 HubSpot API 的分页与去重逻辑。
4. 跨 Agent 兼容性
- Claude Code:✅ 原生支持——README 明确列出,默认安装到项目
.claude/skills/目录 - Codex:❓ 未验证——已抓取材料未点名提及
- OpenClaw:❓ 未验证——已抓取材料未点名提及
- Hermes Agent:❓ 未验证——已抓取材料未点名提及
(README 另提及 Cursor、Windsurf 等其他编程 Agent 兼容,但不在本报告评估范围内)
5. 推荐理由
CRM 数据质量问题(缺字段、拼写不一致、重复记录)几乎是所有长期使用 CRM 的团队都会遇到的隐性成本,这个技能把发现、归一化、合并去重、审计属性四类操作整理成可直接调用的命令模式,还把“跨页去重会漏记录”这种容易踩的坑提前写进文档,配合同仓库统一的 dry-run/digest/confirm 安全闸,能让 Agent 在真实 CRM 数据上可靠地完成批量清理。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 7 | 官方 HubSpot 仓库出品;skills.sh 平台统计该技能独立安装量为 883 次 |
| 可用性 | 8 | 单文件 SKILL.md 完整覆盖属性发现、缺失定位、归一化、合并去重、审计五类操作,均配可直接运行的命令示例;依赖同仓库 bulk-operations 的分页/dry-run 机制;仓库近期仍有提交,维护活跃 |
| 安全性 | 9 | 见下方检查清单 |
安全检查清单:
① Shell 命令及权限范围——通过官方 hubspot CLI 执行,范围限定在该账号可访问的联系人/公司/自定义对象读写
② 联网外发——仅连接用户自己 HubSpot 账号的官方 API,目标透明
③ 凭据——设置环境变量 HUBSPOT_ACCESS_TOKEN 或走浏览器 OAuth 登录,为标准做法,凭据不写入仓库
④ 可疑指令——SKILL.md 内容清晰、逻辑单一,未见隐藏指令或混淆代码
⑤ 作者信誉——HubSpot 官方组织仓库,该 CLI 为其官方公开 Beta 产品
⑥ License——Apache License 2.0,清晰
⑦ 维护时间——仓库最近仍有提交,非弃置项目
额外亮点:合并操作明确标注“不可逆”并给出 history 追溯与 UI 回收站恢复两条兜底路径;批量归一化默认先 --dry-run 预览
7. 跟同类 Skills 相比的优势
| 方案 | 定位 | 差异化说明 |
|---|---|---|
| HubSpot 官方远程 MCP Server(mcp.hubspot.com) | 面向对话式 AI 助手的托管接入点,支持自然语言查改 CRM 对象 | 定位是“对话里查改一条”;crm-data-quality 面向批量脚本化清洗场景,内建跨页去重陷阱提示与 dry-run/digest/confirm 安全闸 |
| TomGranot/hubspot-admin-skills(第三方社区项目,37 个技能,MIT 协议) | 覆盖更广的 HubSpot 数据治理套件——审计、生命周期自动化、评分建模、外部数据增强等,基于 Python 脚本 + REST API,可选接官方 MCP Server 做对话式抽查 | crm-data-quality 由 HubSpot 官方发布、直接建立在官方 hubspot CLI 之上,命令行为一等公民,无需额外 Python 运行环境;聚焦缺失字段/归一化/去重/属性审计四类具体操作,而非覆盖治理全流程的大而全套件 |
8. 用户评价
在同一 HubSpot 仓库的 GitHub Issues 中,用户 WesleyBLDC 分享了真实安装体验:其 Agent 工作区已装有 50 多个来自其他技能包的 skill,crm-data-quality、bulk-operations 等通用命名的技能不带来源前缀,扫描时难以分辨归属,存在潜在命名冲突。该用户在本地 fork 里为全部技能加上 hubspot- 前缀重命名,解决了可发现性问题,并向上游提出了合并请求。这条反馈适用于同仓库下包括 crm-data-quality 在内的全部技能,安装到已有大量技能的工作区时可留意命名冲突。
除此之外,该技能目前在第三方平台尚无更多具名用户评价。
9. 其他补充
同一仓库下另有 14 个姊妹技能(如 bulk-operations、crm-lookup、ticket-resolution、deal-management 等),均依赖 bulk-operations 的分页与批量安全模式。
10. 安装使用方式
# 只安装 crm-data-quality 一个技能
npx skills hubspot/agent-cli-skills/crm-data-quality
# 安装全部 15 个技能
npx skills hubspot/agent-cli-skills
安装后需配置 HubSpot 账号访问:设置环境变量 HUBSPOT_ACCESS_TOKEN(私有应用令牌)或走浏览器 OAuth 登录。建议先安装并阅读 bulk-operations 技能了解 JSONL 管道与 dry-run/digest/confirm 流程。安装后无需重启,在对话中提及 “clean up contacts”、“find incomplete records”、“merge duplicates” 等触发词即可调用。
11. 注意事项
- 依赖官方
hubspotAgent CLI(与开发 HubSpot 应用的hs/@hubspot/cli是两个不同工具),需单独安装 - 枚举属性的可选值不由 CLI 直接暴露,需从真实记录或 HubSpot UI 读取
- 合并操作不可逆,虽有
history追溯与 UI 回收站兜底,仍建议先在小范围数据上试跑 - 跨页去重必须先完整分页收集数据到本地文件再处理,直接对原始流去重会静默漏掉跨页边界的重复记录