MinerU 文档转 Markdown
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_ec02b303/xtyooo-mineru-doc-to-markdown-skill。
技能介绍
解决什么问题
当文档是 PDF、DOC/DOCX、PPT/PPTX、图片或 HTML 时,直接复制正文常会丢失标题层级、表格边界和阅读顺序,也难以继续总结或交给 LLM。该技能将文档转为 Markdown,重点解决转换结果不够稳定、临时请求太分散,以及有 token 与无 token 模式难以统一的问题。
如何工作
它使用 MinerU 的两条解析链路:
- 精准解析模式:存在
MINERU_API_TOKEN或指定--mode precise时触发。本地文件会申请上传地址、上传并轮询任务,最终下载full_zip_url并提取full.md;远程 URL 则创建批量提取任务后轮询结果。 - 轻量 Agent 模式:无 token 或指定
--mode agent时触发。本地文件和远程 URL 都通过 Agent API 创建任务,轮询后下载markdown_url。
默认输出到 outputs/mineru/,日志写入 logs/mineru_markdown.log。full.md 是主产物,.zip 用于排查或复用。转换成功后,应继续读取 Markdown,而不是重复请求转换服务。
适用边界
它适合文档转 Markdown,不适合 xlsx/csv 表格,也不建议用于已贴出文本只要摘要的场景。本地文件和远程 URL 不要混用;大文件在 Agent 模式下限制更严,失败时优先查看 MinerU 错误并考虑拆分文档。
使用场景
- 收到客户 PDF 方案后,先转成 Markdown 再交给 LLM 总结关键条款。
- 把 PPT 和 DOC 里的需求说明整理成 Markdown,便于进入知识库编辑。
- 处理远程网页截图或 HTML 页面,提取可读 Markdown 供后续分析。
- 将本地文档批量转为 Markdown 文件,统一归档并保留排查用 zip。
适合人员
- 处理合同与方案文档的知识工程师,需要把 PDF/DOC 转成可编辑 Markdown。
- 接入 LLM 总结链路的应用工程师,需要稳定的文档结构化输入。
- 维护知识库的内容工程师,需要把 PPT/HTML 内容转成 Markdown 归档。
- 做文档解析流程自动化的后端工程师,需要兼容 token 与免 token 模式。