得理文件 OCR 解析
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_f26b93e2/deli-ocr-file-parse。
技能介绍
解决什么问题
在合同审查、证据整理、票据识别等流程中,Agent 常遇到扫描件 PDF、图片、OFD、Office 表格等文件。原生解析可能缺页、乱码、表格错位,导致后续分析不可靠。该技能把文件解析统一成可继续处理的 Markdown 或 .txt 结果,并在原生能力不足时兜底调用得理 OCR。
工作方式与边界
技能优先使用当前 Agent 或平台能力:
- PDF:先尝试平台解析、
pdfplumber、PyMuPDF等。 - 图片/扫描件:先尝试多模态识别或内置 OCR。
- Office/表格:先尝试
python-docx、openpyxl、CSV/JSON 解析。 - 文本/HTML/Markdown:直接读取,不调用 OCR。
只有当原生解析为空、缺页、乱码,或用户明确要求“用得理 OCR”时,才进入 deli-cli 流程。调用前需完成 CLI 前置,并按当次返回的命令、参数和 RUN 信息执行,不假设固定命令。支持常见 .pdf、.docx、.xlsx、.png、.ofd、.html 等格式;实际能力以当次返回为准。
使用注意
输出至少说明原始文件名、输出路径、是否保存原始响应,以及是否存在缺页、乱码、表格错位、印章或手写识别不确定。不要因已配置 API Key 就自动调用 OCR;大段解析文本应先写入文件再传递;始终保留原始文件。涉及金额、日期、案号、发票号、银行账号等内容时,必须提醒用户复核;处理敏感材料时只输出任务所需片段。
使用场景
- 律师整理证据材料时,把扫描版 PDF 转成可读 Markdown,便于逐条核对日期与金额。
- 法务审阅合同附件时,将 OFD 或图片型合同解析为文本,检查条款、案号和印章是否可读。
- 运营核对报销票据时,把发票图片或 PDF 解析成 Markdown,提取票号、金额和日期供复核。
- 研发整理接口文档时,将 Office 文档或 HTML 页面批量转成 Markdown,便于后续分析引用。
适合人员
- 负责证据整理的律师,要把扫描版 PDF 变成可读文本逐条核对。
- 核对报销票据的财务运营,要把发票图片提取出票号、金额和日期。
- 维护合同库的法务,要把 OFD 或图片合同解析成 Markdown 审阅。
- 开发 Agent 文档流程的工程师,要给原生解析失败的文件加 OCR 兜底。