Agent Skills
返回列表
MinerU 文档转 Markdown

MinerU 文档转 Markdown

办公效率 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_ec02b303/xtyooo-mineru-doc-to-markdown-skill。

技能介绍

解决什么问题

当文档是 PDF、DOC/DOCX、PPT/PPTX、图片或 HTML 时,直接复制正文常会丢失标题层级、表格边界和阅读顺序,也难以继续总结或交给 LLM。该技能将文档转为 Markdown,重点解决转换结果不够稳定、临时请求太分散,以及有 token 与无 token 模式难以统一的问题。

如何工作

它使用 MinerU 的两条解析链路:

  • 精准解析模式:存在 MINERU_API_TOKEN 或指定 --mode precise 时触发。本地文件会申请上传地址、上传并轮询任务,最终下载 full_zip_url 并提取 full.md;远程 URL 则创建批量提取任务后轮询结果。
  • 轻量 Agent 模式:无 token 或指定 --mode agent 时触发。本地文件和远程 URL 都通过 Agent API 创建任务,轮询后下载 markdown_url。

默认输出到 outputs/mineru/,日志写入 logs/mineru_markdown.log。full.md 是主产物,.zip 用于排查或复用。转换成功后,应继续读取 Markdown,而不是重复请求转换服务。

适用边界

它适合文档转 Markdown,不适合 xlsx/csv 表格,也不建议用于已贴出文本只要摘要的场景。本地文件和远程 URL 不要混用;大文件在 Agent 模式下限制更严,失败时优先查看 MinerU 错误并考虑拆分文档。

使用场景

  • 收到客户 PDF 方案后,先转成 Markdown 再交给 LLM 总结关键条款。
  • 把 PPT 和 DOC 里的需求说明整理成 Markdown,便于进入知识库编辑。
  • 处理远程网页截图或 HTML 页面,提取可读 Markdown 供后续分析。
  • 将本地文档批量转为 Markdown 文件,统一归档并保留排查用 zip。

适合人员

  • 处理合同与方案文档的知识工程师,需要把 PDF/DOC 转成可编辑 Markdown。
  • 接入 LLM 总结链路的应用工程师,需要稳定的文档结构化输入。
  • 维护知识库的内容工程师,需要把 PPT/HTML 内容转成 Markdown 归档。
  • 做文档解析流程自动化的后端工程师,需要兼容 token 与免 token 模式。