Agent Skills
返回列表
📁

PDF 阅读助手

办公效率 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_2dc8a2f8/pdf-reader-assistant。

技能介绍

解决的问题

PDF 内容分析常卡在三类场景:纯文本 PDF 能快速读取,但扫描版、复杂表格、图片注记需要额外处理;单篇研报、论文或合同需要目录、摘要、关键词和表格汇总;多篇文档需要横向比较,而不是一篇篇人工复制。PDF 阅读助手 面向这些工程侧读取任务,把 PDF 提取、结构化分析和多文档对比组织成可复用流程。

工作方式

  • 文本提取:优先提取可读文本,并通过前 5 页文字量判断是否像扫描版;必要时切换到 OCR,顺序尝试 pytesseract 与 easyocr。
  • 结构化分析:输出目录、头部/中部/尾部摘要、Top 15 关键词、Markdown 表格、图片注记,以及总字数、中文字数、英文单词数和数字出现次数。
  • 多文档对比:对多个 PDF 做快速摘要,再比较共同关键词和差异要点。
  • 批量处理:扫描目录中的 .pdf 文件,按每份少量页生成文件名、页数、字数、Top5 关键词和表格数量汇总表。
  • 大文件策略:超过 50 页时先取前 5 页和目录,再按用户关注章节按页码范围精读,避免一次性加载过多上下文。

边界与注意

  • 加密 PDF 需要提供密码才能读取。
  • 表格提取和 OCR 属于可选增强,缺少依赖时会跳过并注明。
  • 中文扫描版识别需要系统具备简体中文字识别能力。
  • 提取结果会写入临时文件并在用后清理。

使用场景

  • 收到 50 页以上研报,先读前 5 页目录,再按指定章节精读关键数据。
  • 整理合同文本时,从 PDF 中提取关键信息、表格和统计数字,形成摘要材料。
  • 比较三份供应商 PDF 方案,输出各自摘要、共同关键词和差异要点。
  • 批量扫描项目目录,生成所有 PDF 的页数、字数、Top5 关键词和表格数量。

适合人员

  • 需要快速判断长 PDF 是否值得深读的分析师,诉求是从目录和摘要定位重点章节。
  • 处理扫描版论文或合同的法务,诉求是在缺少干净文本时提取正文、表格和关键词。
  • 要比较多份供应商或竞品 PDF 的运营,诉求是得到摘要、共同关键词和差异要点。
  • 批量整理资料夹的文档工程师,诉求是生成每份 PDF 的页数、字数、Top5 关键词和表格数。