效率与协作 ✓ Anthropic · 官方 pdf-extractionpdf-mergingpdf-splittingpdf-formspdf-generationocrtable-extraction

Anthropic PDF 文档处理技能

帮助 Claude 读取、转换、生成和管理 PDF 文档。

FollowSkills 评估 · FSRS-2.0
不推荐
45/ 100 五分制 2.3 / 5
1 2 3 4 5 6
1信任安全12 / 25 · 2.4/5

提供本地 PDF 处理示例,未见恶意行为或隐蔽外传;但涉及解密、密码保护、覆盖式修复和文件写入,却未规定用户确认、权限最小化、敏感数据处理、输出回滚或数据流披露,因此扣分。

2可靠稳定7 / 20 · 1.8/5

核心路径有 Python、命令行和表单脚本示例,脚本内容可读;但静态材料未提供测试或执行证据,依赖可用性、异常输入处理和失败诊断不完整,且 SKILL.md 引用的 REFERENCE.md、FORMS.md 与实际小写文件名不一致,因此限制为中低分。

3适用触发9 / 15 · 3.0/5

触发条件和 PDF 任务覆盖范围清晰,涵盖读取、转换、表单、OCR、创建和修改;但非适用边界、输入输出契约、平台要求及中文场景未说明,依赖本地 Python、Poppler、Tesseract 等环境,故未接近满分。

4规范维护6 / 15 · 2.0/5

有概览、快速开始、分层参考、脚本和故障排查,命名基本清楚;但安装依赖、版本与变更记录、维护责任、更新路径和许可证治理不完整,且文档文件名引用存在大小写不一致,因此扣分。

5有效结果7 / 15 · 2.3/5

示例覆盖大量常见 PDF 操作,理论上可直接改写使用;但本次仅静态阅读,没有代表性输出或执行验证,复杂表单、OCR、布局和跨工具兼容性仍可能需要较多人工检查,按静态上限计分。

6证据核验4 / 10 · 2.0/5

源码、脚本和依赖许可证信息提供了一定可审计材料;但没有提交的测试套件、CI 覆盖、真实运行日志或第三方复核,结论主要来自静态代码检查,故仅给有限分。

证据充分度: 评估于 2026年7月19日 审查版本 fa0fa64bdc96
上游仓库在本次评估后已有新提交;当前评分仍对应所示审查版本,可能尚未覆盖最新改动。
使用前请注意
  • 运行前需确认所有外部依赖已安装,并核对文档引用的文件名大小写。
  • 解密、密码处理、覆盖输入文件或生成敏感输出前,应获得用户明确确认并保留可恢复副本。
  • OCR、表格提取、表单坐标和 PDF 布局结果未有静态材料证明可靠,必须人工复核。
  • 未提供中文说明或中文 OCR/字体兼容性指导,中文用户可能需要额外配置。
查看完整评分方法 →

这个 Skill 能做什么,适合哪些场景?

这是 anthropics/skills 仓库中的 PDF 处理技能,面向涉及 PDF 文件的读取、提取、编辑和生成任务。它提供基于 Python 库和命令行工具的操作示例。支持文本与表格提取、PDF 合并和拆分、页面旋转、加水印、图片提取、OCR、表单处理及密码保护。该技能的许可证标注为 Proprietary,README 将相关文档技能描述为 source-available,而非开源。

使用 pypdf 读取 PDF、提取文本和元数据、合并或拆分页面、旋转页面及加密文件;使用 pdfplumber 提取文本和表格,并可借助 pandas 合并表格数据;使用 reportlab 创建单页或多页 PDF;使用 pytesseract 与 pdf2image 对扫描 PDF 执行 OCR;使用 pdftotext、pdfimages、qpdf 和 pdftk 执行命令行提取、图片导出、合并、拆分、旋转和解密操作。

  1. 需要从 PDF 中提取正文、页数或作者等元数据的研究人员。
  2. 需要从报表 PDF 中提取表格并合并为数据集的数据分析人员。
  3. 需要将多个 PDF 合并,或按页面拆分文件的办公用户。
  4. 需要创建报告、添加水印、旋转页面或设置密码保护的文档处理人员。
  5. 需要把扫描 PDF 转换为可搜索文本的用户。
  6. 需要处理 PDF 表单的用户,但具体表单流程需参考未提供的 FORMS.md。

这个 Skill 有哪些优点和局限?

优点
  • 覆盖 PDF 读取、提取、编辑、生成、OCR 和安全处理等多类任务。
  • 同时提供 Python 和命令行示例,便于脚本化和批处理。
  • 包含文本、表格、图片和元数据等不同内容类型的处理方法。
  • 明确提醒 ReportLab 不应使用 Unicode 上标和下标字符,以避免字体渲染问题。
局限
  • SKILL.md 标注为 Proprietary,README 将相关文档技能列为 source-available,而非开源。
  • 示例依赖多个 Python 库和命令行工具,环境准备成本可能较高。
  • 没有提供测试套件、版本要求或跨平台验证信息。
  • 高级用法和 PDF 表单流程依赖未包含在给定材料中的 REFERENCE.md 与 FORMS.md。

如何安装这个 Skill?

在 Claude Code 中运行 /plugin marketplace add anthropics/skills,然后安装 document-skills@anthropic-agent-skills/plugin install document-skills@anthropic-agent-skills。README 没有单独说明将 skills/pdf 文件夹复制到其他客户端的安装步骤。

如何使用这个 Skill?

安装 document-skills 后,直接提出包含 PDF 文件操作的请求,例如:Use the PDF skill to extract the form fields from path/to/some-file.pdf。SKILL.md 说明,只要用户提到 .pdf 文件或要求生成 PDF,就应使用该技能。

这个 Skill 与同类方案有什么区别?

README 提到 document-skills 插件和 example-skills 插件,但没有提供其他 PDF 技能或工具的直接比较。

常见问题

这个技能是开源的吗?
不能这样确认。SKILL.md 标注许可证为 Proprietary,README 说明相关文档技能是 source-available,而不是 open source。
使用它需要哪些工具?
材料展示了 Python 生态中的 pypdf、pdfplumber、pandas、reportlab、pytesseract 和 pdf2image,以及 pdftotext、pdfimages、qpdf、pdftk 等命令行工具;未给出完整安装清单或版本要求。
它能处理扫描 PDF 吗?
可以。示例使用 pdf2image 将页面转换为图片,再使用 pytesseract 对每页执行 OCR。
它是否包含 PDF 表单处理的完整说明?
SKILL.md 指示在需要填充表单时阅读 FORMS.md,但给定材料没有提供该文件的内容。

同仓库的其他 Skills

均来自 anthropics/skills

相关 Skills