MD 格式互转工具
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_98283d0f/md-converter-pro
技能介绍
问题背景
日常处理文档时,Markdown、PDF、DOCX、HTML、TXT 之间经常需要来回转换。手动打开多个工具、检查依赖和输出质量,容易遗漏编码、标题层级和危险标签等问题。该技能把这些转换收敛到一个文档格式互转引擎中,适合需要批量处理或重复转换的团队。
工作方式
它支持 8 种转换方向:MD → PDF、MD → DOCX、MD → HTML、MD → TXT,以及 PDF → MD、DOCX → MD、HTML → MD、TXT → MD。不同方向依赖不同解析或渲染库,例如 DOCX 转换依赖 python-docx,HTML 转 MD 依赖 markdownify,PDF 提取依赖 pdfminer.six。
当仓库中存在 scripts/common/security.py 时,会自动启用安全模块:路径沙箱限制输入输出目录,文件大小限制默认 50MB,HTML/MD 清洗会移除危险标签,异常信息中的路径、用户名和 IP 也会被脱敏。若该文件不存在,则跳过安全检查以保持兼容。
当输出为 MD 且存在 scripts/common/quality.py 时,会进行质量校验:检测 PDF 文本层乱码,比较输入输出词数比例,并检查标题层级连续性。结果会写入同名 .quality.json,同时在终端输出评分。
适用边界
它更适合文本层完整的文档转换,不含 OCR,扫描版 PDF 需先外部识别。中文字符乱码常见于源文件非 UTF-8 或 PDF 文本层损坏。批量转换失败时,优先检查文件类型、体积和依赖是否齐全。
使用场景
- 把仓库里的 Markdown 文档批量转成 PDF 和 DOCX,用于客户交付
- 将 PDF 技术说明和 HTML 邮件稿统一转回 MD,方便继续编辑
- 处理内部分享的 DOCX/HTML 文档,转成 Markdown 时启用路径沙箱
- 把 TXT 笔记转换为 Markdown,并检查标题层级是否连续
适合人员
- 维护产品文档的工程师:需要把 MD 规范导出为 PDF/DOCX 供评审
- 整理资料的分析师:要把 PDF/HTML 来源统一转回 MD,便于后续检索编辑
- 交付客户材料的架构师:需要批量转换 DOCX/HTML 并启用路径沙箱
- 内容运营:需要把 TXT/MD 清理转换为可发布的 HTML 或 PDF