1. 基本信息
| 项目 | 内容 | 数据来源 |
|---|---|---|
| 正式名称 | pdf-viewer(合集子技能,完整标识 pdf-viewer-anthropics-knowledge-work-plugins) | GitHub |
| 作者/维护者 | Anthropic | plugin.json |
| 来源链接 | https://github.com/anthropics/knowledge-work-plugins/tree/main/pdf-viewer | — |
| 许可证 | 所属合集仓库 Apache-2.0;核心依赖的本地 MCP 渲染服务 @modelcontextprotocol/server-pdf 为 MIT |
GitHub API + npm registry |
| 所属合集仓库 Stars/Forks | 23,423 / 2,823(该数字属整个合集仓库,不代表本插件自身热度) | GitHub API |
| 最新版本 | 0.2.0(插件) / 1.7.5(底层渲染服务 npm 包,持续发版中) | plugin.json + npm registry |
| 安装方式 | Claude Code 插件市场一条命令安装(见第 10 章) | 官方仓库说明 |
2. 功能介绍与亮点
pdf-viewer 让 Claude 在一个实时渲染的可视化窗口里“陪你看 PDF”,而不是把内容读成一堆文字:
- 打开与浏览:支持本地文件、arXiv 论文链接(自动转 PDF)、以及 bioRxiv / Zenodo / OSF 等站点的直链 PDF
- 协作式标注:高亮、下划线、删除线、便签、自由文本、矩形/圆形框选、连线箭头,Claude 会分批提出标注建议,用户逐批确认后再落笔
- 表单填写:不仅支持按字段名批量填,还专门处理“字段名是
Text1/Field_7这种看不出含义”的刁钻表单——通过截图比对页面上打印的可视化标签来定位该填什么 - 图章与签名:可放置 APPROVED / DRAFT / CONFIDENTIAL 等图章,也可把签名或首字母图片贴到指定坐标;文档明确声明这是可视化图章,不是具备法律效力的加密数字签名
- 导出:标注完成后从查看器工具栏直接下载带标记的副本
亮点:官方 Anthropic 出品,产品边界写得克制——SKILL.md 明确“纯文本摘要/抽取请直接用 Read,不要用本插件”;底层依赖 Model Context Protocol 官方组织维护的开源渲染服务(@modelcontextprotocol/server-pdf),无需任何 API Key 或第三方账号。
3. 适用场景
所属分类:文档与办公自动化
- 审阅合同、论文或审批单时,希望边看边圈重点、留下可视化批注痕迹,而不是只拿到一段摘要文字
- 需要填写字段命名混乱、必须靠肉眼对照页面文字才能确定该填什么的 PDF 表单
- 给文档盖上 APPROVED / DRAFT 等审批戳,或放置一个可视签名/首字母(非正式法律签名场景)
- 受益人群:需要频繁批注合同/论文/审批文件的知识工作者、法务与行政助理、做文献批注的学生与研究者
4. 跨 Agent 兼容性
- Claude Code:✅ 原生支持——
claude plugin marketplace add anthropics/knowledge-work-plugins添加市场后一条命令安装,插件自带的本地 MCP 服务随会话自动拉起 - Codex:❓ 未验证——插件清单是 Claude 专属的
.claude-plugin/plugin.json格式,未见官方或第三方给出 Codex 下的安装说明 - OpenClaw:❓ 未验证
- Hermes Agent:❓ 未验证——底层渲染服务是标准 MCP server,理论上任何支持 MCP 的 agent 均可接入,但未发现实测证据
补充说明:官方仓库自述“主要面向 Claude Cowork 场景的知识工作者”,Claude Code 是其另一条明确写出的可用路径。
5. 推荐理由
在同类 PDF 处理技能里,pdf-viewer 是少数装完不用配任何第三方账号就能直接用的一个——不需要 API Key,不需要企业版 SaaS 订阅,只需本机装了 Node.js。它解决了一个具体痛点:很多 PDF 表单字段命名毫无意义,程序化填表工具猜不出该填什么,pdf-viewer 靠“截图比对页面可视标签”反而更可靠。加上官方一手维护、底层渲染服务由 MCP 官方组织持续发版,供应链可信度高。
6. 评分
| 维度 | 分数 | 说明 |
|---|---|---|
| 受欢迎程度 | 7 | Anthropic 官方出品(所属合集仓库的开发方与发布方即 Anthropic 自身);该子技能自身暂未见独立于合集的第三方媒体报道或量化采用数据 |
| 可用性 | 8 | 安装为单条市场命令,SKILL.md/README 文档完整且给出清晰的示例工作流;无需 API Key 或付费账号,仅需本机 Node.js;该子目录最近一次实质性更新距今约 4 个多月 |
| 安全性 | 9 | 见下方安全检查清单 |
安全检查清单:
- shell/权限范围:
npx在本机拉起一个已发布的 MCP 服务进程,仅用于渲染与标注 PDF,不涉及通用 shell 执行 - 联网外发:仅在用户提供远程 PDF 链接时抓取该链接,无其他数据外发
- 凭据要求:无需任何 API Key 或账号登录
- 可疑指令排查:文档表述克制、边界清晰,未见可疑指令或隐蔽外发
- 作者信誉:Anthropic 官方;底层渲染服务由 Model Context Protocol 官方组织维护并持续发版(v1.7.5)
- License:合集仓库 Apache-2.0,底层渲染依赖 MIT,均明确
- 维护时间:该子目录最近一次实质性提交约 4 个多月前
7. 跟同类 Skills 相比的优势
市面上还有几款同样处理 PDF 的技能,但定位互不重叠:
| 技能 | 核心定位 | 与 pdf-viewer 的差异 |
|---|---|---|
pdf(Anthropic 官方,anthropics/skills) |
用 pdfplumber/pypdf/OCR 等脚本做批量文本抽取、表格转 Excel、合并拆分加水印、程序化表单填充 | 面向“批处理与结构化提取”,产出是文本/数据;pdf-viewer 面向“边看边改”的可视化交互,产出是带标注的 PDF 本身 |
| adobe-create-pdfs-from-data(Adobe 官方) | 用 CSV 名单批量套用固定版式模板,生成证书等个性化 PDF | 定位是“从数据批量生成新 PDF”;pdf-viewer 处理的是已存在的 PDF,不涉及批量生成 |
| minimax-pdf(MiniMax AI) | 用统一的设计 token 体系从零生成出版级观感的正式 PDF 报告 | 定位是“从零做出漂亮的新文档”;pdf-viewer 不做排版设计,只做既有文档上的标注与签署 |
三者都在“处理 PDF”这件事上着力,但分别覆盖抽取/生成/标注三个不同环节,彼此更像互补而非替代。
8. 用户评价
该技能目前在第三方社区平台尚无具名用户评价;能确认的是它已被至少一家第三方 Claude 插件目录站(mcpmarket.com)单独收录为“Interactive PDF Viewer”条目,并有开发者将其复制进个人插件合集仓库,说明已进入社区可发现范围,但尚未形成公开的具名口碑。
9. 安装使用方式
# 1. 添加插件市场
claude plugin marketplace add anthropics/knowledge-work-plugins
# 2. 安装 pdf-viewer 插件
/plugin install pdf-viewer
安装后无需重启,插件会在需要时自动通过 npx 拉起本地 PDF 渲染服务(首次运行会有一次 npm 包下载)。触发方式:直接让 Claude “打开这份 PDF”“帮我批注这份合同”“填一下这个表单”,Claude 会按 SKILL.md 中的判断逻辑决定是否调用查看器。
四个命令可直接调用:/pdf-viewer:open、/pdf-viewer:annotate、/pdf-viewer:fill-form、/pdf-viewer:sign。
10. 注意事项
- 本机需装有 Node.js ≥ 18;首次启动本地服务需要联网下载 npm 包
- 签名/首字母功能只是把图片贴到页面坐标上,不是具备法律效力的加密数字签名,正式签署场景请使用专门的电子签名服务
- 定位是“可视化交互标注”,不适合纯文本摘要或大批量抽取场景——那类需求用 Claude 原生的 Read 或专门的批处理型 PDF 技能更高效
- 跨 Claude Code 以外的 agent 生态(Codex / OpenClaw / Hermes Agent)兼容性未经验证