WiseOCR 文档识别转 Markdown
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_a457224d/wiseocr-new。
技能介绍
要解决的问题
- 扫描件、截图、单页或单文件 PDF 中的文字需要转成可编辑的
Markdown,但本地 OCR 往往依赖较重,直接接云端服务又容易写成零散请求代码。 - 这个技能针对单个 PDF 或图片文件,调用 WiseDiag OCR 生成 Markdown,并把结果直接落到固定工作目录。
工作方式
- 支持输入格式:
PDF、jpg、jpeg、png、webp、gif、bmp、tiff。 - 需要预先配置 WiseDiag API Key,脚本从环境变量读取;使用方式上避免直接手写 HTTP 请求。
- 关键参数包括输入文件、输出文件名 stem、输出目录和 PDF 渲染
DPI;DPI默认 200,范围 72-600。 - 当输入文件被复制、改名或位于临时路径时,建议显式传原始文件名 stem,避免输出文件命名不可读。
- 结果保存为
Markdown文件,默认在~/.openclaw/workspace/WiseOCR/{name}.md,无需额外手动保存。
适用边界
- 文件会上传到 WiseDiag 云端处理,不适合敏感、保密或合规要求高的文档。
- 资料描述为处理单个文件,不适合批量目录、复杂版式重建或需要本地私有 OCR 的场景。
- 云端处理意味着网络可用性、API 可用性和第三方数据策略都会影响实际使用。
使用场景
- 把单页合同扫描件识别为可编辑 Markdown,便于后续校对和归档。
- 将产品截图中的参数表识别为 Markdown,贴进文档或知识库。
- 把单文件 PDF 讲义转成 Markdown,再做章节整理与摘要。
- 把图片型说明书转成 Markdown,方便检索条目和复制步骤。
适合人员
- 负责把单份扫描件整理成可编辑文本的文档运营。
- 需要把截图参数录入知识库、但不想手写识别脚本的工程师。
- 处理单文件 PDF 讲义并生成 Markdown 的讲师或研究人员。
- 维护图文资料库、要把图片说明转成 Markdown 的内容编辑。