PDF 文档转 Skill 工作台
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_b818ef37/pdf2skill。
技能介绍
要解决的问题
专业 PDF 里的表格、参数、计量规则、适用条件常被拆散在几十页正文中。直接让模型阅读容易出现跨行截断、合并单元格丢失、凭记忆补数据等问题,也难以把文档变成后续任务可直接调用的结构化资源。
技能如何工作
该技能把 PDF 转成可分发的 WorkBuddy Skill:先用 fitz 与 pdfplumber 双通道提取文本和表格,再按数据层、规则层、模板层拆分资源文件;SKILL.md 定义工作模式、调用优先级、校验规则和输出格式。关键步骤包括:
- 先输出《文档分析报告与Skill方案.md》并等待确认,避免一次性提取。
- 指标、系数、模板写入
resources/资源文件,保持来源页码和单位可溯源。 - 用 Python 脚本做数据抽样、跨文件一致性、边界条件和计算复算。
- 打包前完成覆盖矩阵、页码统计、章节遗漏检测和三级抽样验证。
适用边界与注意
它适合 ≥20 页、含规则/参数/表格的文档,如工程造价、技术标准、SOP、产品参数、财务测算。不适用于小说、报告、演示文稿等纯叙述内容。使用前需明确确认范围,分发版资源路径必须使用相对路径,且校验规则要覆盖互斥、优先和边界条件。
使用场景
- 把 40 页工程造价 PDF 中的计量规则、系数和适用条件拆成可调用资源文件。
- 将产品参数手册的表格、兼容性矩阵和选型约束整理为带页码来源的 Skill 资源。
- 依据 SOP 文档生成步骤校验、前置条件检查和边界提示,供后续问答复用。
- 在打包前核对 PDF 章节覆盖、跨文件指标一致性和计算案例可复算性。
适合人员
- 整理工程造价与技术标准文档的知识工程负责人,需要把规则参数固化为可追溯资源。
- 维护产品手册问答库的产品运营,需要把参数表和选型约束变成可调用 Skill。
- 负责 SOP 自动问答的运营工程师,需要提取步骤、前置条件和异常边界。
- 交付内部文档工具的应用工程师,需要完成 PDF 资源拆分、校验和分发包检查。