翔云开放平台文档表格识别
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_6b190ef3/doc-ocr-xy。
技能介绍
解决的问题
文档里的表格、发票、扫描件常以 PDF、OFD、图片形式存在,人工转录容易漏字段、成本高。翔云开放平台文档识别-表格识别适合把一批非结构化文档批量送入 OCR,拿到可处理的结构化文本,作为后续解析、入库或表格抽取的基础。
技能如何工作
这个技能围绕翔云 OCR 的 netocr_key 与 netocr_secret 工作,首次使用必须完成凭证配置。核心流程通常是:
- 准备输入文件:支持
.pdf、.ofd,以及.jpg、.png、.bmp、.tif、.webp等图片格式; - 选择语言代码:如简体中文印刷为
0、英文为2、日文为11,印刷+手写可选对应代码; - 调用批量识别:把文件交给翔云 OCR,按次计费,返回识别结果供后续处理。
它适合需要把多语言文档统一转为文本的工程场景,尤其是 PDF/OFD 扫描件、票据、表格截图等。
适用边界与注意点
资料未承诺表格结构化输出,因此如果目标是直接得到行列结构,建议把识别文本作为中间结果,再叠加表格解析逻辑。图片需清晰,建议长宽大于 500px;单文件不超过 10MB。配置文件保存在技能目录下的 config.json,凭证属于敏感信息,注意不要提交到仓库或日志中。翔云 OCR 按次计费,批量任务前先小样本验证费用与识别效果。
使用场景
- 将一批PDF或OFD扫描件的表格文本批量识别,作为后续字段抽取输入
- 把日文、韩文、西文等印刷文档从图片转成文本,便于统一入库
- 在票据和表单图片预处理后,调用OCR拿到文字结果供规则校验
- 对多语言合同扫描件先识别文字,再交人工或程序复核关键条款
适合人员
- 需要把 PDF/OFD 扫描件文字化并做字段抽取的文档处理工程师
- 每周处理多语言票据、表单,希望把图片文字转成可校验文本的运营
- 负责接入第三方 OCR,需要管理凭证和批量任务的后端开发
- 需要将外文合同或表格先识别再人工复核的合规审查专员