Agent Skills
返回列表
PDF 结构化知识整理

PDF 结构化知识整理

知识管理 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,将 @user_bbd16bf9/pdf-to-knowledge 安装到 AI 助手中。

技能介绍

解决的问题

PDF 笔记往往夹杂页码、页眉、表格、示意图和层级不清的标题,直接转 Markdown 容易变成碎片化文本。该技能面向工程师处理学习材料、手册、课程笔记,要求从当前 PDF 抽取可维护的知识文档。

工作方式

核心是“理解后重组”而非机械搬运:先做文本/页面提取与质量检查,再按 # → ## → ### 建立结构,去噪页眉页脚,合并同类知识点,并把表格转为 Markdown 表格。遇到图片会识别流程图、界面截图、表格截图等知识价值,保留 ./images/ 相对引用并补充说明。若内容模糊、分类不清或粒度不确定,会主动询问而不是猜测。批量处理时逐个生成 _知识整理.md,最后再生成 Wiki.md 建立章节索引。

适用边界

它强调只使用当前 PDF 作为知识来源,禁止用其他已生成文件补全缺失内容。OCR 结果可信度较低,无法识别处需要标注 [待确认] 或 [提取失败]。适合结构较清晰、以文本和图表为主的 PDF;扫描版、公式密集或低质量扫描件仍需人工校对。

使用场景

  • 把课程 PDF 讲义中的章节、定义和例题整理成层级清晰的 Markdown 笔记。
  • 处理技术手册 PDF,提取配置步骤、界面截图和流程图,并在对应位置保留图片引用。
  • 批量转换目录下多份 PDF 讲义,逐个生成独立知识整理文件,最后生成 Wiki 索引。
  • 核对低质量 PDF 的乱码、缺页和表格错位,显式标注提取失败而不是猜测补全。

适合人员

  • 整理课程讲义的学生,想把 PDF 中的章节、定义和例题转成可复习的 Markdown 笔记。
  • 维护技术文档的工程师,需要把 PDF 手册里的配置步骤、截图和流程图转成结构化参考。
  • 做知识管理的团队负责人,希望批量处理多个 PDF 并生成统一的 Wiki 索引。
  • 负责标注质量审核的人员,要求保留不确定项和提取失败项,而不是自动补全内容。