PDF 文档助手
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,将 @user_3cdbf8ea/pdfzhushou 安装到你的 AI 助手中。
技能介绍
问题
处理 PDF 时,常见动作往往分散在多个 GUI 工具或临时脚本中:把几个文件合并、按页拆分、提取文本、设置密码、查看页数和文件信息。若环境受限,依赖安装也会成为阻碍。PDF助手 把这些动作收敛为可被 Agent 直接调用的 Python 函数,减少重复写脚本的成本。
工作方式
技能核心是 scripts/tool.py 中的工具函数,优先使用 PyMuPDF(fitz),并在缺少外部依赖时尝试降级运行。可用能力包括:
- 合并 PDF:
merge_pdfs(paths, output)将多个文件合并为一个,适合归档或提交材料。 - 拆分 PDF:
split_pdf(path, output_dir)按页生成单独文件,便于分发单页。 - 提取文本:
extract_text(path)读取 PDF 文本内容,可用于后续总结或检索。 - 加密 PDF:
encrypt_pdf(path, password, output)为文件设置打开密码。 - 分析信息:
analyze_pdf(path)返回文件基本信息,便于判断页数与结构。
调用时只需提供文件路径、目标目录、密码或输出路径等参数,函数会返回结构化结果,方便 Agent 继续处理。
适用边界
该技能适合处理已有 PDF 文件的合并、拆分、文本提取、加密和基础分析。它不是在线转换器或 OCR 服务;若任务涉及复杂版面重排、扫描件识别或批量服务端处理,仍需结合专门工具。运行前建议先确认路径可访问、输出目录可写,并核对目标 PDF 是否受保护。
使用场景
- 把三份本地 PDF 合同合并成一份提交件,并确认输出文件已生成。
- 将 12 页 PDF 拆成单页,方便发给不同审批人逐页查看。
- 从 PDF 中提取正文文本,用于后续人工校对和摘要整理。
- 给内部技术说明 PDF 设置打开密码,避免未授权人员直接查看。
适合人员
- 需要整理交付材料的工程师:把多份 PDF 版本合并成一份最终提交文件。
- 负责审批流转的运营:把长 PDF 拆成单页,方便逐页反馈。
- 做资料归档的行政:给内部 PDF 设置密码并查看页数等基础信息。
- 需要文本抽取的研究助理:从 PDF 中提取正文文本用于后续整理。