Agent Skills
返回列表
📁

PDF 文档助手

办公效率 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,将 @user_3cdbf8ea/pdfzhushou 安装到你的 AI 助手中。

技能介绍

问题

处理 PDF 时,常见动作往往分散在多个 GUI 工具或临时脚本中:把几个文件合并、按页拆分、提取文本、设置密码、查看页数和文件信息。若环境受限,依赖安装也会成为阻碍。PDF助手 把这些动作收敛为可被 Agent 直接调用的 Python 函数,减少重复写脚本的成本。

工作方式

技能核心是 scripts/tool.py 中的工具函数,优先使用 PyMuPDF(fitz),并在缺少外部依赖时尝试降级运行。可用能力包括:

  • 合并 PDF:merge_pdfs(paths, output) 将多个文件合并为一个,适合归档或提交材料。
  • 拆分 PDF:split_pdf(path, output_dir) 按页生成单独文件,便于分发单页。
  • 提取文本:extract_text(path) 读取 PDF 文本内容,可用于后续总结或检索。
  • 加密 PDF:encrypt_pdf(path, password, output) 为文件设置打开密码。
  • 分析信息:analyze_pdf(path) 返回文件基本信息,便于判断页数与结构。

调用时只需提供文件路径、目标目录、密码或输出路径等参数,函数会返回结构化结果,方便 Agent 继续处理。

适用边界

该技能适合处理已有 PDF 文件的合并、拆分、文本提取、加密和基础分析。它不是在线转换器或 OCR 服务;若任务涉及复杂版面重排、扫描件识别或批量服务端处理,仍需结合专门工具。运行前建议先确认路径可访问、输出目录可写,并核对目标 PDF 是否受保护。

使用场景

  • 把三份本地 PDF 合同合并成一份提交件,并确认输出文件已生成。
  • 将 12 页 PDF 拆成单页,方便发给不同审批人逐页查看。
  • 从 PDF 中提取正文文本,用于后续人工校对和摘要整理。
  • 给内部技术说明 PDF 设置打开密码,避免未授权人员直接查看。

适合人员

  • 需要整理交付材料的工程师:把多份 PDF 版本合并成一份最终提交文件。
  • 负责审批流转的运营:把长 PDF 拆成单页,方便逐页反馈。
  • 做资料归档的行政:给内部 PDF 设置密码并查看页数等基础信息。
  • 需要文本抽取的研究助理:从 PDF 中提取正文文本用于后续整理。