Agent Skills
返回列表
TextIn xParse 文档解析

TextIn xParse 文档解析

办公效率 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_2e25d6a2/xparse-parser。

技能介绍

要解决的问题

文档解析经常卡在几个点:PDF/图片/Office 格式分散、解析结果需要按页或章节检索、多文件批处理容易重复提交、免费/付费配额与 OAuth 身份边界不清。直接把文档塞给通用模型或脚本,常常缺少稳定的 doc_id、导航缓存、任务状态和配额反馈,导致结果不可复现。

技能如何工作

TextIn xParse Document Parse 将执行核心交给已安装的 xparse-cli,Skill 只负责编排调用与约束行为。单文档或 URL 使用 parse;多个本地文件、需要持久 task_id、状态查询、导出或失败恢复时,使用 durable Task Runtime。默认 --api auto 会先查询配额并优先消耗免费额度;--api paid 仅在用户明确批准后使用。对于本地文档,完整 parse 会生成导航缓存,随后用 get_doc_info、get_outline、search_text、read_pages 和 read_content 做定向读取。失败时解析 xparse_error.v1,按 retryable 与 next_action 决定最多一次同逻辑重试或停止。

适用边界

该技能面向解析、导航和批量任务控制,不替代业务后处理。免费端点通常支持 PDF 与图片,Office、HTML、OFD 等可能需要付费路由。多文档任务不能拆成并行 parse 来规避配额;waiting_paid_authorization、waiting_funds 等状态需要外部确认后通过 task resume 继续。

使用场景

  • 把合同 PDF 解析成 Markdown,再用 search_text 查金额、日期和违约条款。
  • 将多份本地报告提交为一个 durable Task,保留 task_id 供后续导出或恢复。
  • 在解析 Office 或 OFD 前判断免费额度是否足够,并按批准结果切换付费路由。
  • 对长文档生成导航缓存,再用 get_outline、read_pages 和 read_content 定位章节。

适合人员

  • 需要把 PDF 合同转成可检索 Markdown 并抽取条款的法务分析或文档工程师。
  • 需要批量处理本地 Office/PDF 并保留 Task ID 以便导出、查询或恢复的数据运营。
  • 需要在免费/付费额度边界下选择 xParse 路由的自动化工程师。
  • 需要按章节、关键词和页码从长文档抽取内容的 RAG 工程师。