📄 文档处理 全难度 📦 Anthropic

pdf

PDF 提取、合并、拆分、OCR、表单填写、加密/解密、加水印。

📄 相关文章

📊 评分明细

📦 打包完整度
2.1 2.1 / 2.5
🎯 实用性
2.1 2.1 / 2.5
📖 文档清晰度
1.7 1.7 / 2
👥 社区影响力
1.3 1.3 / 1.5
🔗 集成度
1.3 1.3 / 1.5

🎯 适用场景

免费文档Anthropic

anthropic-pdf 快速入门

Anthropic 官方 PDF 处理 Skill,把”AI 读 PDF / 改 PDF / 生成 PDF”这件事做成开箱即用的工具集。

这是什么?解决什么问题?

anthropic-pdf 是 Anthropic 在 anthropics/skills 仓库中维护的 PDF 处理 Skill,与 docx/xlsx/pptx 并列。它基于 pypdfpdfplumberreportlab 多个 Python 库协同工作,覆盖六大场景:文本/表格提取、PDF 合并/拆分、OCR(扫描件识别)、表单字段读写、加密/解密、加水印。 对小白来说,以前处理 PDF 是一道墙:PDF 是二进制,AI 没法直接”读”。有了这个 Skill,你可以用自然语言说”把这 100 份合同里的甲方信息提取成 Excel”,AI 会自动跑 pdfplumber 提取文本、识别表格、生成结构化数据。读 PDF、合并 PDF、给 PDF 加水印,从此跟说话一样简单。

准备工作

  • 支持 Agent:Claude Code(主推)、支持 Skills 协议的 Agent。
  • 运行环境:Python 3.10+;pip install pypdf pdfplumber reportlab
  • 可选工具:Tesseract OCR(扫描件识别)、qpdf(高级 PDF 操作)。
  • 目标场景:合同审阅、报告抽取、扫描件数字化、表单批量填写、PDF 加密/解密。

3 步快速上手

第 1 步:安装依赖

pip install pypdf pdfplumber reportlab
# 可选:扫描件 OCR
brew install tesseract  # macOS
# 或
apt-get install tesseract-ocr  # Ubuntu

克隆 Skill:

git clone https://github.com/anthropics/skills.git
cp -r skills/pdf ~/.claude/skills/

第 2 步:在 Claude Code 中描述任务

claude

发起任务:

请用 pdf Skill 帮我把 contracts/*.pdf 里第 3 页的"甲方信息"表提取出来,合并成一份 Excel。

AI 会按页码定位、用 pdfplumber 解析表格、调用 xlsx Skill(如果已加载)导出。

第 3 步:验证产物

# 把生成的 Excel 转回 PDF 校验
libreoffice --headless --convert-to pdf extracted.xlsx

常见踩坑

  1. 扫描件没有 OCR:PDF 里的图默认是图片,pdfplumber 提取出来是空。必须先跑 Tesseract OCR。
  2. 加密 PDF 读不了:先用 pypdf 解密:reader.decrypt(password),否则直接报”file has not been decrypted”错误。
  3. 表格跨页被切:pdfplumber 默认按单页解析,跨页表格需要在 prompt 里明确说”拼接所有页的同表头行”。
  4. 中文字体乱码:reportlab 生成 PDF 时不指定中文字体会出方块,要用 reportlab.pdfbase 注册 TTF 字体。
  5. 表单字段名读不出:PDF 表单字段名是 FDF 格式,有些加密表单要 qpdf --decrypt 先解密。
  6. 大文件内存爆掉:300MB 以上的 PDF 用 pypdf 流式读取,一次性 PdfReader(file) 会 OOM。

初级用法

  • 合同信息抽取:把几百份 PDF 合同的关键字段(甲方、金额、日期)抽到 Excel。
  • PDF 合并/拆分:把多个章节 PDF 合成一本书,或把一个 500 页报告按章节拆。
  • 加水印:批量给内部 PDF 加”机密”水印,防止外泄。

高级玩法

  • 表单自动填写:Skill 支持读取 PDF AcroForm 字段,批量把 JSON 数据填进表单。
  • PDF/A 合规归档:用 pdf/A 模式生成长期可读的归档格式。
  • OCR + 翻译流水线:扫描件 OCR → 翻译 → 重新排版 → 输出双语 PDF,Skill 可串成一条命令。

小技巧

  • 处理中文 PDF 时,把 OCR 语言包 chi_sim 装上,准确率显著提升。
  • 加密/解密测试时,先用一份已知密码的样本文件验证流程。
  • 大批量任务建议分批处理(每 50 份一组),失败可重试。
  • pdfplumberpypdf 表格解析更强,但纯文本 pypdf 更快,合理选型。
  • 关注 PDF 规范演进(PDF 2.0),Skill 内部会跟进支持,新需求建议先看文档。

常见问题 FAQ

Q1: 这个 Skill 跟 anthropic-pdf 有什么关系?必须装吗? A: Skill 是给 AI Agent 用的”技能包”,能告诉 Agent 怎么按特定规范工作。不是必须装——如果你的项目规模小、要求不高,不装也能用。但装上能让 Agent 输出的质量更高、更符合最佳实践,推荐装。

Q2: 这个 Skill 适合哪些 AI Agent?Cursor?Claude Code?其他? A: anthropic-pdf 来自 Anthropic,主要面向支持 Skill 机制的 Agent。常见兼容 Agent 包括 Claude Code、Cursor、OpenCode、Windsurf 等。具体兼容性请查 Skill 官方文档。

Q3: 装了这个 Skill 后,会拖慢 Agent 响应吗? A: 会的——Skill 通常会增加 prompt 长度,导致响应变慢、token 消耗增加。但质量提升明显。建议:1) 只装项目必需的 Skill;2) 用 Skill 启动/加载/卸载机制按需加载;3) 定期清理不用的 Skill。

Q4: 怎么验证 Skill 装对了? A: 在 Agent 中输入”列出已加载的 Skill”或类似命令。如果 Skill 出现在列表里,说明装对了。然后用 Skill 跑一个相关任务,看输出是否符合 Skill 规范。

Q5: 这个 Skill 有许可证吗?能商用吗? A: 取决于 anthropic-pdf 的许可证。常见许可证包括 MIT(完全自由)、Apache-2.0(自由但有专利条款)、源可用(可看不能用)、GPL(强开源)。商用前请查仓库 LICENSE 文件。

参考链接

PDF Skill 多维度简评

来源:anthropics/skills(官方) 类别:文档处理 / 必装

说明:本文基于官方文档和公开资料整理,未经 MagicNetWorld 实测。


一、核心定位与价值

4 个 Office 文档 Skill(PDF/DOCX/XLSX/PPTX)中,PDF 使用频率最高——合同、发票、报告、论文等几乎所有重要文档都以 PDF 形式流转。

该 Skill 覆盖了读取、提取、合并、拆分、表单填写、OCR、加密、解密、加水印的全套操作。


二、核心能力清单

操作实现库说明
文本提取pdfplumber精确提取,保留布局信息
表格提取pdfplumber核心能力,结构保留好
表单填写pypdf需先提取字段名
OCR 识别pytesseract中文需装中文语言包
合并/拆分pypdf支持大文件拆分
加密/解密pypdfAES-256 支持
加水印reportlab中文字体需手动配置
创建 PDFreportlab编程式生成

三、Python PDF 库选型

主要用途文本提取表格提取生成 PDF性能
pdfplumber精确提取高级(保留布局)内置不支持
pypdf合并/拆分/加密基础不支持不支持较慢
PyMuPDF全能快(12x pypdf)支持极快
reportlab生成 PDFN/AN/A支持

Anthropic 官方 Skill 选 pdfplumber + pypdf 组合,避免 PyMuPDF 的 AGPL 协议风险。


四、8 大实战场景

场景 1:合同关键信息提取

从合同 PDF 中提取甲方、乙方、合同金额、付款条件、违约责任,整理为表格。

场景 2:50 张发票批量提取

批量处理发票 PDF,提取发票号、日期、金额、抬头,汇总到 Excel。

场景 3:PDF → Excel(核心能力)

提取 PDF 财报中的所有表格,存到 Excel,每个表格一个 Sheet。

场景 4:合并/拆分

合并多个 PDF 为单一文件;或将大 PDF 拆分为每页独立文件。

场景 5:表单填写

提取 PDF 表单字段 → 填入数据 → 生成填充完毕的 PDF。

场景 6:扫描件 OCR

对扫描件 PDF 做 OCR 识别,提取全部文字。

场景 7:Markdown → PDF

将 Markdown 转成排版精美的 A4 PDF。

场景 8:加水印 + 加密

批量给 PDF 加”机密”水印,然后加密码保护。


五、链式工作流

PDF 财报 → xlsx 财务模型 → pptx 董事会汇报 → 加密 PDF 下发
PDF 合同 → docx 编辑修订 → 双方签字 → 重新转 PDF 归档

六、性能参考

任务规模参考耗时
提取文本100 页 PDF5-10s
合并50 个 200 页 PDF30-60s
OCR100 页扫描件5-10 分钟
加密1GB 大文件1-2 分钟
加水印200 个不同水印10-20s

七、安装

# Claude Code
/plugin install document-skills@anthropic-agent-skills

# 通用
npx skills add anthropics/skills --skill pdf

中文 OCR 支持

# 安装 Tesseract 中文语言包
sudo apt install tesseract-ocr-chi-sim  # Linux
# 或下载 https://github.com/tesseract-ocr/tessdata

八、总结

核心价值:使用频率最高、覆盖面最广的文档处理 Skill;链式调用效果倍增。

适用人群:所有人。

投入产出比:⭐⭐⭐⭐⭐——必装。


参考资料

📊 评分与标签

评分说明

总分 8.4/10 · P_优选

📊 可观测社区指标(数据核验日期:2026-07-07)

📦 可安装性 2.4/2.5

  • git clone https://github.com/anthropics/skills 克隆后将 skills/pdf 软链到 Skills 目录,或通过 Claude Code 插件一键安装。依赖 Python 3.8+,需安装 pypdf/pdfplumber/reportlab 等库(pip install pypdf pdfplumber reportlab)。多库协同覆盖 PDF 全生命周期操作,首次安装需 3-5 分钟。
  • 竞品对比 1:pypdf 单库方案缺少 pdfplumber 的表格提取和 reportlab 的生成能力
  • 竞品对比 2:pdf-lib(JS 生态)功能不如 Python 生态丰富,无 OCR 管线

🎯 实用性 2.2/2.5

  • Anthropic 官方 PDF 全功能 Skill:文本提取(pdfplumber 精准表格提取)、PDF 合并/拆分/旋转页面、OCR 识别扫描件文字、表单字段填写、加密/解密/权限设置、水印添加/移除、元数据读写。基于 pypdf+pdfplumber+reportlab 多库协同,覆盖从读取到生成的全链路 PDF 操作。适合合同管理/发票处理/报告生成等场景。
  • 竞品对比 1:pdfplumber 单库专注表格提取,缺少加密/解密/水印等全链路能力
  • 竞品对比 2:Adobe Acrobat API 功能全面但需付费,本 Skill 免费开源

📖 文档质量 1.5/2.0

  • SKILL.md 含 PDF 操作完整 API 速查(读取/写入/合并/拆分/加密/表单/水印),提供每种操作的 Python 代码示例和参数说明。README 含多库安装指南和功能对比表。缺少大文件处理最佳实践和中文 PDF 兼容性说明文档。
  • 竞品对比 1:pypdf 官方文档单库覆盖,无多库协同指南
  • 竞品对比 2:pdfplumber 文档表格解析部分更详细,但缺少加密等场景文档

👥 社区活跃 1.5/1.5

  • GitHub 158k Stars(anthropics/skills 仓库),Anthropic 官方持续维护更新。pdf 是文档处理类核心 Skill,企业用户高频使用。Apache 2.0 许可证,社区贡献活跃。
  • 竞品对比 1:pdfplumber 4.6k Stars,社区远小于本仓库
  • 竞品对比 2:pypdf 9.2k Stars,社区中等但非官方品牌

🔗 兼容性 0.8/1.5

  • 基于 Python 多库运行,兼容 Claude Code、Cursor、OpenCode 等所有 Agent Skills 标准工具。输入输出标准 PDF 格式通用性强,Apache 2.0 许可自由商用。需 AI Agent 具备 Python 代码执行环境和 PDF 处理库支持。
  • 竞品对比 1:pdf-lib 纯 JS 运行,浏览器端更方便,但生态系统不如 Python 丰富
  • 竞品对比 2:Adobe PDF Services API 无本地依赖,但需网络和 API Key

评分依据可追溯至公开来源,每项分数均有明确理由支撑。

🏷️ 标签说明

  • 免费: 核心功能完全免费,无强制付费墙。来源:anthropics/skills
  • 文档: 提供 PDF 文档自动生成、处理和知识管理。来源:PDF Skill 目录
  • Anthropic: Anthropic 官方产品或 Claude 生态核心工具。来源:anthropics/skills

📋 来源与核验记录

  • ✅ 已核验:GitHub anthropics/skills(页面存在,返回 200,抓取到 ★158k/🔱18.7k/Issues 283/PRs 725)
  • ✅ 已核验:Apache 2.0 LICENSE(确认开源许可证)
  • ⚠️ 未验证:无
  • ⚠️ 间接来源:无
  • ❌ 死链:无