1. 基本信息
| 项目 | 内容 |
|---|---|
| 名称 | import-starrocks-starrocks-debug-skills |
| 作者/维护者 | StarRocks(Linux Foundation 旗下开源 OLAP 数据库项目官方团队) |
| 来源链接 | https://github.com/StarRocks/starrocks-debug-skills/tree/main/import |
| 许可证 | Apache License 2.0(GitHub API 确认) |
| GitHub Stars | 仓库整体 72(GitHub API;本技能为合集仓库中的独立子技能,此数字为仓库整体热度参考,非本模块单独热度,详见“评分”一节说明) |
| Forks | 12(GitHub API) |
| 最新版本 | SKILL.md 内声明 version 2.0.0;仓库最近一次提交 2026-05-26(GitHub API) |
| 安装方式 | 官方 install.sh 一键安装(全部模块),或手动复制 import/ 目录 |
2. 功能介绍与亮点
import 是一份专注于 StarRocks 数据导入管线故障的调查手册,覆盖 Stream Load、Broker Load、Routine Load、INSERT INTO 与 Flink Connector 五类导入方式的六种根因(文档内称 Cause A–F):写入慢(线程池瓶颈、BRPC/网络问题、主键索引重建)、发布超时(Compaction 滞后)、读取慢(Kafka 分区瓶颈)、RPC Failed(统计信息采集与导入争抢 BRPC 队列)。内容按四阶段组织:Phase 1 通过 FE 事务日志区分“写慢”还是“发布慢”;Phase 2 用 Load Profile 定位具体瓶颈环节;Phase 3 给出每种根因对应的确认条件与修复命令(如动态调整 number_tablet_writer_threads、开启 skip_pk_preload、关闭统计信息自动采集);Phase 4 给出复原验证的 SQL 与日志检查清单。文档附 5 条完整因果链(触发条件→可观测信号→处置动作)与 4 个可追溯真实案例编号,并链接到跨模块级联指南(统计信息采集拖垮 BRPC 进而波及查询的复合故障)。
主要亮点:官方 StarRocks 团队出品;该模块的“数据导入超时排查”场景正是官方项目公告文章(Towards Data Engineering,Medium)中作为首个示例场景(“Scenario 1: Imports Keep Timing Out”)详细展开的内容,可见其在项目对外介绍中的代表性;仓库设有 CI lint 工作流校验内容一致性;开源、Apache-2.0 协议、无付费依赖。
3. 适用场景
所属分类:DevOps 与基础设施
面向负责运维 StarRocks 生产集群的 SRE / DBA / 平台工程师,在 Stream Load、Broker Load、Routine Load、INSERT INTO 或 Flink 写入任务出现导入变慢、超时、RPC 失败或 PK 表发布阻塞等生产问题时,按本技能给出的判定树定位根因并采取缓解措施。
4. 跨 Agent 兼容性
- Claude Code:✅ 原生支持——仓库提供
install.sh --tool claude-code --target ~/.claude/skills/官方安装命令,直接生成标准 SKILL.md 目录结构 - Codex:❓ 未验证——官方安装脚本未将 Codex 列为目标平台,未见相关测试或说明
- OpenClaw:❓ 未验证——同上,官方材料未提及
- Hermes Agent:❓ 未验证——同上,官方材料未提及
(官方脚本另支持 Cursor 与 JetBrains IDE,但两者不在本报告追踪的四个生态范围内。)
5. 推荐理由
官方 StarRocks 团队把分散的生产运维经验系统化为结构化的 AI 故障排查手册,import 模块专精覆盖数据导入管线(Stream/Broker/Routine Load、Flink)的超时与失败场景,是项目官方公告文章重点展开的示例场景,对运维数据写入链路的工程师有直接、可操作的诊断价值。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 7 | 官方 StarRocks(Linux Foundation 旗下项目)团队出品,配发专门的工程博客文章介绍,且本模块的故障场景是文章重点展开的示例;但技能仓库本身创建于 2026 年 4 月,尚属年轻项目,子技能级别的独立热度证据(如安装量、专属讨论)有限 |
| 可用性 | 8 | SKILL.md 提供清晰的四阶段判定流程(区分写慢/发布慢/读慢)、精确到具体命令与 SQL 的诊断步骤,附 5 条完整因果链与 4 个可追溯真实案例;官方脚本支持多 IDE 一键安装;但实际操作需要用户对目标 StarRocks 集群具备访问权限与一定运维背景,非纯粹复制即用 |
| 安全性 | 9 | 检查清单见下 |
安全检查清单:
① 是否执行 shell 命令及权限范围:涉及的命令均为诊断与参数调优(curl 读取 BE 本地监控端口、grep/netstat/tcpdump 排查、SQL UPDATE information_schema.be_configs 调整线程池/超时等运行时参数),均作用于用户自有集群、目的明确,未见破坏性操作
② 运行时是否联网外发数据:无,全部诊断在用户自有集群本地执行,不涉及外部网络请求
③ 是否要求 API key/凭据及其存储方式:不涉及
④ SKILL.md 与脚本中有无可疑指令:未发现提示词注入或隐蔽指令迹象;仓库设有 CI 关键词过滤工作流
⑤ 作者/组织信誉:StarRocks 官方项目团队,与主数据库仓库同属一个 GitHub 组织
⑥ License 是否明确:明确,Apache License 2.0
⑦ 最近维护时间:最近一次提交 2026-05-26,距今约两个月,未见 archived 标记
7. 跟同类 Skills 相比的优势
| 技能 | 定位 | 与本技能的差异 |
|---|---|---|
| import-starrocks-starrocks-debug-skills | StarRocks 数据导入管线故障(超时/RPC 失败/发布阻塞)排查 | — |
| node-starrocks-starrocks-debug-skills(同仓库姊妹模块) | StarRocks 服务进程级故障(OOM/崩溃/死锁/GC)排查 | 诊断对象是节点进程本身是否存活,而非写入链路是否顺畅,两者互补覆盖不同故障域 |
| mongodb-query-optimizer(MongoDB 官方) | 诊断慢查询并给出复合索引建议 | 聚焦查询语句本身的性能优化,不覆盖数据写入/导入管线的超时与失败场景 |
| weaviate-weaviate-agent-skills(Weaviate 官方) | 向量数据库的语义搜索、schema 管理与批量数据导入 | 面向向量检索场景的数据写入,与 OLAP 集群的 Stream/Broker/Routine Load 管线故障排查是完全不同的技术栈与问题域 |
同类数据库技能中,查询优化类聚焦“改 SQL”,节点诊断类聚焦“进程还活不活”,本技能则专门覆盖“数据写得进不进得去、写得快不快”这一独立故障域,三者合起来才是一套完整的数据库运维诊断体系。
8. 用户评价
该技能目前在第三方平台尚无具名用户评价。StarRocks 官方工程博客(Towards Data Engineering,2026 年 5 月)在项目介绍文章中以“Imports Keep Timing Out”为首个示例场景,具体讲解了如何通过线程池饱和度检查与 BE 自动诊断日志定位导入超时根因,是目前可查证的最直接的第三方使用说明。仓库 Issue 区可见一条用户提问“有没有性能分析 skill”,显示有真实用户在关注该项目的模块覆盖范围。
9. 其他补充
同仓库还有 12 个姊妹模块(node/query/compaction/balance/data-lake/tablet/deployment/high-concurrency/resource-isolation/materialized-view/shared-data/cpu-saturation),分别覆盖不同症状域,构成一套完整的 StarRocks 故障排查体系;仓库 guides/ 目录下还有跨模块级联案例(如统计信息采集拖垮 BRPC 进而波及导入与查询的复合故障排查路径),把多个模块的判定树串联起来处理复合型故障。
10. 安装使用方式
方式一(官方脚本,一次安装全部 13 个模块):
git clone https://github.com/StarRocks/starrocks-debug-skills
cd starrocks-debug-skills
./scripts/install.sh --tool claude-code --target ~/.claude/skills/
方式二(仅安装本模块):手动将仓库内 import/ 目录(含 SKILL.md 与 references/)复制到 ~/.claude/skills/import/。
安装后注意事项:Claude Code 重启会话后自动加载新技能;技能按 SKILL.md 的 description 字段中的症状关键词(如“Stream Load timeout”“RPC Failed”“publish timeout”)由 Claude 自动匹配触发,无需手动调用;实际执行文档中的诊断命令需要用户对目标 StarRocks 集群具备 SSH 或监控端口访问权限,部分修复命令(如调整 BE 配置)需要相应的集群管理权限。
11. 注意事项
- 仓库创建于 2026 年 4 月,最近一次实质性提交在 2026 年 5 月,案例库仍在持续补充中,属早期项目
- 部分诊断依赖 v3.4+/v3.5+ 才引入的自动诊断日志(
profile=与DIAGNOSE堆栈跟踪),版本过低的集群需退回手动读取 Load Profile 等通用方法 - 官方一键安装脚本会同时安装全部 13 个模块,没有提供“仅安装单个模块”的命令行参数,只安装本模块需手动筛选目录
- 仅覆盖 StarRocks 这一特定数据库的内部机制(导入线程池、BRPC、PK 索引等),不适用于其他数据库系统