Agent Skills
返回列表
VA DocParse 文档解析

VA DocParse 文档解析

办公效率 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_15292d5a/yjkj-va-docparse。

技能介绍

解决的问题

扫描件和复杂 PDF 里的文字、表格、公式很难直接进入下游流程。va-docparse 面向这类文档解析场景,通过 MCP Server 调用远程解析服务,把 PDF、扫描版 PDF 和常见图片格式转成可读取的结构化内容,减少本地依赖 OCR 环境、手写解析逻辑和维护多格式识别成本。

如何工作

技能会监听 OCR、文档解析、识别、读取 等意图,并在满足条件时调用 parse_document 工具。输入是待解析文件的绝对路径,可选 output_format 为 markdown、json 或 both。服务返回提取后的文本内容;失败时返回带错误代号的信息,例如 [F001] 文件不存在、[F002] 文件不可读、[F003] 格式不支持。批量处理时,每个文件独立调用;用户要求合并时按顺序合并,并保留脱敏文件名与失败代号。

适用边界

支持 PDF、扫描版 PDF、PNG、JPG、JPEG,不支持音频、视频、风景照、人物照,也不直接支持 Word、Excel、PPT,需要先转成 PDF。结果应原样返回 MCP 服务响应,不做无依据改写、补全或扩写。配置缺失、网络异常或服务错误时,应输出错误代号并停止后续步骤,避免暴露 MCP 地址、密钥、底层命令等敏感信息。

使用场景

  • 收到扫描版 PDF 合同,需要先把正文和表格转成 Markdown 再审核。
  • 从 PNG/JPG 截图里识别页面文字、表格和公式,写入技术笔记。
  • 批量处理多份图片单据,逐份调用解析并保留失败代号。
  • 将旧版 Python 解析脚本迁移到 MCP 的 `parse_document` 接口。

适合人员

  • 整理扫描合同或报告的文档工程师,需要把 PDF 内容转成可编辑文本。
  • 维护 MCP 工作流的应用开发者,需要稳定调用文档解析 Tool。
  • 处理截图或照片证据的合规人员,需要提取图片中的文字和表格。
  • 做数据录入的产品运营,需要把多份图片单据内容批量转成文本。