1. 基本信息
| 项目 | 内容 | 数据来源 |
|---|---|---|
| 名称 | qdrant-monitoring | SKILL.md |
| 作者/维护者 | Qdrant 官方仓库 qdrant/skills;核心提交者包括 Qdrant CTO Andrey Vasnetsov(GitHub: generall)及多名 Qdrant 工程师 |
GitHub API / 官方发布博客 |
| 来源链接 | https://github.com/qdrant/skills/tree/main/skills/qdrant-monitoring | — |
| 许可证 | Apache License 2.0 | GitHub API |
| GitHub Stars / Forks | 所属仓库 208★ / 23 forks(该数字属整个 Qdrant Skills 合集,不代表本技能个体热度,仅供了解所属仓库规模) | GitHub API |
| 最新版本 | SKILL.md 未单独标注版本号,随仓库持续滚动更新;本技能最近一次内容提交为 2026-06-16 | 仓库提交历史 |
| 安装方式 | 见第 9 章 | 官方 README |
2. 功能介绍与亮点
qdrant-monitoring 把“怎么判断 Qdrant 是否健康、出问题了怎么查”这套运维知识拆成两条路径:
- 监控搭建:Prometheus 指标抓取端点、Kubernetes 健康探针(
/healthz//livez//readyz)、Hybrid Cloud 场景下需额外抓取的 cluster-exporter 与 operator 指标、告警阈值建议(如磁盘使用率超 80%)、审计日志落盘与集中化方案 - 故障排查:针对“优化器卡住”“内存异常增长”“查询变慢”三类常见生产问题,给出具体要查的指标名称(如
rest_responses_avg_duration_seconds)、API 端点(如 v1.17+ 的/collections/{name}/optimizations)与判断标准 - 反模式清单:明确列出“不该做什么”,例如不要把页面缓存占满内存误判为异常、不要在自建部署上抓取仅云端可用的
/sys_metrics
亮点:内容标注了具体的 Qdrant 版本号(v1.8+、v1.17+ 等),随产品演进持续修订;仓库内有一条 2026-06-29 提交的讨论记录提到“agent 曾同时加载监控与性能两个技能处理同一类问题”,说明这套技能确实被拿来实际使用过并据此调整结构。
3. 适用场景
所属分类:DevOps 与基础设施
适用于已经把 Qdrant 用在生产环境的团队:例如刚上线时需要一次性搭好 Prometheus/Grafana 监控和告警规则,或线上出现“索引优化器迟迟跑不完”“某个节点内存疯涨”“查询延迟突然变高”等情况时,把这份指南交给编码 Agent,能直接定位到该看哪个指标、哪个 API 端点。
4. 跨 Agent 兼容性
- Claude Code:✅ 原生支持。官方 README 提供
/plugin marketplace add qdrant/skills插件市场安装,也可克隆仓库后复制到~/.claude/skills/ - Codex:✅ 支持。仓库 README 明确列出 OpenAI Codex 为受支持 Agent,并给出
~/.codex/skills/的手动安装路径 - OpenClaw:✅ 支持。Qdrant 官方发布博客(qdrant.tech/blog/qdrant-skills-release)明确写明技能“适用于任何支持 skills 格式的 Agent(Cursor、Claude Code、OpenClaw、OpenCode、OpenAI Codex、Pi)”,OpenClaw 与 OpenCode 分别被列出;仓库 README 的安装目录表未单独给出 OpenClaw 的路径
- Hermes Agent:❓ 未验证。官方 README 与发布博客均未提及 Hermes Agent
5. 推荐理由
多数数据库的监控文档只告诉你“有哪些指标”,很少直接回答“内存涨到多少该慌”“优化器卡住第一步该查哪个端点”。这份指南把这类判断标准写清楚,并标注了对应的 Qdrant 版本号,对已经在生产环境跑 Qdrant、但没有专职 DBA 天天盯盘的团队来说,是一份可以直接照做的排障手册。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 5 | 仓库整体规模有限(208★);本技能自身有 9 次提交,参与者包含 Qdrant CTO 本人及多名工程师,持续维护约 4 个月,且有开发者在 PR 讨论中反馈过真实使用体验,但尚无第三方平台的独立讨论 |
| 可用性 | 9 | 纯文本指南,一次复制/安装即可使用,无需任何账号或 API key;最近一次内容修订为 2026-06-16,维护活跃 |
| 安全性 | 9 | 声明的可用工具仅 Read/Grep/Glob,不含可执行 shell 命令,不发起网络外联,全文未见可疑指令;许可证明确 |
安全检查清单:① 仅声明 Read/Grep/Glob 只读权限,无广泛 shell/联网权限;② 运行时不联网外发数据;③ 不要求任何 API key 或凭据;④ 全文核查未发现可疑指令或 prompt injection 迹象;⑤ 作者为 Qdrant 官方仓库,核心提交者含 CTO 本人,无造假迹象;⑥ License(Apache-2.0)明确;⑦ 最近一次内容提交为 2026-06-16,维护活跃
综合评分:7.7(三项均值)
7. 跟同类 Skills 相比的优势
| Skill | 定位 | 与本技能的差异 |
|---|---|---|
| victoriametrics-skills(VictoriaMetrics 官方) | 覆盖通用时序监控数据库自身的查询语法、异常检测与告警配置 | 教会 Agent 操作 VictoriaMetrics 这套监控系统本身,不含任何 Qdrant 专属指标的含义或异常阈值判断 |
| grafana-oss-grafana-skills(Grafana 官方) | 帮 Agent 配置仪表盘、数据源与权限(RBAC) | 解决的是“怎么把可视化界面搭起来”,但不知道该在面板上放哪些 Qdrant 指标、数值多少算异常 |
qdrant-monitoring 的差异化在于:它不教你怎么用某个监控平台,而是直接给出“Qdrant 场景下该看什么、正常范围是多少”的领域判断——这部分知识恰恰是通用监控工具的官方文档不会覆盖的。
8. 用户评价
该技能目前在 Reddit、Hacker News 等第三方社区平台尚无独立具名用户评价。
9. 安装使用方式
- 完整安装(含本技能):运行
npx skills add qdrant/skills,会安装仓库内全部技能,包括 qdrant-monitoring - 仅安装本技能:
npx skills add qdrant/skills/skills/qdrant-monitoring - Claude Code 插件市场:依次执行
/plugin marketplace add qdrant/skills与/plugin install qdrant@qdrant - 手动安装:克隆仓库后,将
skills/qdrant-monitoring/目录复制到对应 Agent 的技能目录(Claude Code 为~/.claude/skills/,Codex 为~/.codex/skills/) - 免安装替代方案:官方还提供
qdrant-advisor元技能,安装后会在每次会话中实时从 skills.qdrant.tech 拉取最新指导,无需为技能内容更新而重新安装 - 安装后无需重启,Agent 会根据用户提问中的关键词(如“怎么监控 Qdrant”“优化器卡住”“内存突然变大”)自动触发该技能
10. 注意事项
- 内容聚焦于该看哪些指标、什么情况算异常,不含完整的 Prometheus/Grafana 部署脚本,实际搭建仍需结合各自平台的官方文档
- 部分排障建议绑定具体 Qdrant 版本行为(如 v1.17+ 才有的 optimizer 状态端点),使用较旧版本 Qdrant 时需自行核对是否适用
- 仓库 README 注明整个技能集“处于活跃开发中,内容与结构可能随 Qdrant 演进变化”,建议关注仓库更新