Agent Skills
返回列表
WiseOCR 文档识别转 Markdown

WiseOCR 文档识别转 Markdown

办公效率 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_a457224d/wiseocr-new。

技能介绍

要解决的问题

  • 扫描件、截图、单页或单文件 PDF 中的文字需要转成可编辑的 Markdown,但本地 OCR 往往依赖较重,直接接云端服务又容易写成零散请求代码。
  • 这个技能针对单个 PDF 或图片文件,调用 WiseDiag OCR 生成 Markdown,并把结果直接落到固定工作目录。

工作方式

  • 支持输入格式:PDF、jpg、jpeg、png、webp、gif、bmp、tiff。
  • 需要预先配置 WiseDiag API Key,脚本从环境变量读取;使用方式上避免直接手写 HTTP 请求。
  • 关键参数包括输入文件、输出文件名 stem、输出目录和 PDF 渲染 DPI;DPI 默认 200,范围 72-600。
  • 当输入文件被复制、改名或位于临时路径时,建议显式传原始文件名 stem,避免输出文件命名不可读。
  • 结果保存为 Markdown 文件,默认在 ~/.openclaw/workspace/WiseOCR/{name}.md,无需额外手动保存。

适用边界

  • 文件会上传到 WiseDiag 云端处理,不适合敏感、保密或合规要求高的文档。
  • 资料描述为处理单个文件,不适合批量目录、复杂版式重建或需要本地私有 OCR 的场景。
  • 云端处理意味着网络可用性、API 可用性和第三方数据策略都会影响实际使用。

使用场景

  • 把单页合同扫描件识别为可编辑 Markdown,便于后续校对和归档。
  • 将产品截图中的参数表识别为 Markdown,贴进文档或知识库。
  • 把单文件 PDF 讲义转成 Markdown,再做章节整理与摘要。
  • 把图片型说明书转成 Markdown,方便检索条目和复制步骤。

适合人员

  • 负责把单份扫描件整理成可编辑文本的文档运营。
  • 需要把截图参数录入知识库、但不想手写识别脚本的工程师。
  • 处理单文件 PDF 讲义并生成 Markdown 的讲师或研究人员。
  • 维护图文资料库、要把图片说明转成 Markdown 的内容编辑。