VA DocParse 文档解析
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_15292d5a/yjkj-va-docparse。
技能介绍
解决的问题
扫描件和复杂 PDF 里的文字、表格、公式很难直接进入下游流程。va-docparse 面向这类文档解析场景,通过 MCP Server 调用远程解析服务,把 PDF、扫描版 PDF 和常见图片格式转成可读取的结构化内容,减少本地依赖 OCR 环境、手写解析逻辑和维护多格式识别成本。
如何工作
技能会监听 OCR、文档解析、识别、读取 等意图,并在满足条件时调用 parse_document 工具。输入是待解析文件的绝对路径,可选 output_format 为 markdown、json 或 both。服务返回提取后的文本内容;失败时返回带错误代号的信息,例如 [F001] 文件不存在、[F002] 文件不可读、[F003] 格式不支持。批量处理时,每个文件独立调用;用户要求合并时按顺序合并,并保留脱敏文件名与失败代号。
适用边界
支持 PDF、扫描版 PDF、PNG、JPG、JPEG,不支持音频、视频、风景照、人物照,也不直接支持 Word、Excel、PPT,需要先转成 PDF。结果应原样返回 MCP 服务响应,不做无依据改写、补全或扩写。配置缺失、网络异常或服务错误时,应输出错误代号并停止后续步骤,避免暴露 MCP 地址、密钥、底层命令等敏感信息。
使用场景
- 收到扫描版 PDF 合同,需要先把正文和表格转成 Markdown 再审核。
- 从 PNG/JPG 截图里识别页面文字、表格和公式,写入技术笔记。
- 批量处理多份图片单据,逐份调用解析并保留失败代号。
- 将旧版 Python 解析脚本迁移到 MCP 的 `parse_document` 接口。
适合人员
- 整理扫描合同或报告的文档工程师,需要把 PDF 内容转成可编辑文本。
- 维护 MCP 工作流的应用开发者,需要稳定调用文档解析 Tool。
- 处理截图或照片证据的合规人员,需要提取图片中的文字和表格。
- 做数据录入的产品运营,需要把多份图片单据内容批量转成文本。