文件格式转换助手
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_f88d4da5/file-format-exchange。
技能介绍
问题场景
当办公材料在 TXT、DOCX、PDF、XLSX、HTML、CSV 和 Markdown 之间流转时,手动复制粘贴容易丢失表格、标题层级和列表结构;批量文件还要逐个打开、另存、核对状态。这个技能把常见格式互转收敛为可复用的处理流程,适合工程师把文件转换嵌入自动化脚本,而不是依赖零散小工具。
工作方式与核心能力
该技能基于 Python 3.8+,采用分层架构,将格式读写、转换映射和界面交互拆开。核心路径围绕 references/file_adapter.py 与 references/converter.py:先确认源文件和目标格式,再按支持的转换映射校验路径,随后调用相应库完成读写。能力包括单文件转换、批量转换、DOCX 与 Markdown 双向互通,以及输出 DOCX 时指定中文字体和字号。批量处理时单个文件失败不会阻断其他文件,结果可以按成功或失败状态查看。
适用边界与注意
它更适合文本、文档、表格、HTML 和 Markdown 的结构化转换,而不是图像、扫描版 PDF 或复杂版式还原。PDF 中文输出依赖系统中文字体,缺少时可能回退为西文字体;大文件转换可能耗时,建议分批处理。若需要无人值守运行,优先使用编程接口或命令行批量脚本;若需要人工选择字体、字号和输出目录,再使用桌面 GUI。
使用场景
- 把一批 `DOCX` 需求文档批量转成 `Markdown`,保留标题层级、列表和表格,方便写入仓库或知识库。
- 将客户发来的 `XLSX` 数据表转成 `CSV`,用于后续脚本清洗、入库或自动化处理。
- 把 `PDF` 报告转成 `DOCX`,并指定中文字体和字号,便于排版校对或二次编辑。
- 用 Python API 在流水线中把 `HTML` 内容转成 `Markdown`,避免手动复制导致结构丢失。
适合人员
- 每周要把多份需求文档从 `DOCX` 转成 `Markdown` 并归档到代码仓库的产品工程师。
- 经常把客户 `XLSX` 表格转成 `CSV` 做数据清洗和自动化入库的数据工程师。
- 需要把 `PDF` 报告转成可编辑 `DOCX` 并控制中文字号的运营或内容编辑。
- 想通过 Python API 把文件转换嵌入脚本流水线、避免手动另存的开发工程师。