任意内容转 Markdown
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_6fb740e8/anything-to-markdown。
技能介绍
问题
当需求材料以 docx、pdf、pptx、xlsx、网页、JSON、图片、录音或 zip 包存在时,模型侧后续处理需要一个可稳定读取的纯文本基础。手工复制会丢失表格结构、顺序和识别置信度,而直接让大模型“整理”又容易混入摘要、推测和额外结论。
工作方式
本技能只做 格式转换到 Markdown:
md/txt直接读取并规范化;docx、pdf、pptx、xlsx、csv、html、json、xml通过MarkItDown转换;- 扫描件和图片优先走
Tencent OCR,必要时用视觉模型转录版式; - 音频优先走
Tencent ASR,不可用时回落到 LLM 音频转录; zip批量路由,并输出manifest.md记录文件、路由、状态和失败原因。
转换结果尽量保留原文顺序、用词、数字、时间戳和表格结构;OCR/ASR 不确定处用 [无法识别] 或 [听不清] 标记,不补写缺失内容。
适用边界
该技能不用于需求分析、产品范围、假设抽取、总结、建议或交接文档生成。若源文件是视频、YouTube 链接、EPUB 或任意二进制,默认不支持,需要改提供常见格式导出。providers.json 可能包含密钥,输出和日志中不得泄露。
使用场景
- 把产品评审留下的 PPT、Word 和表格统一转成 Markdown,供后续模型读取,不额外生成摘要。
- 将扫描版 PDF 和会议纪要图片逐页 OCR 成 .raw.md,保留看不清处标记,方便后续校对。
- 把客户提供的 ZIP 材料包批量路由转换,生成 manifest.md 标记成功、失败和跳过文件。
- 将销售通话录音转成纯 ASR 文本 Markdown,不做摘要、行动项或业务判断,便于人工回听核对。
适合人员
- 负责把客户需求材料整理成可检索文本的售前工程师,要求转换结果不引入额外分析。
- 需要把录音、截图和表格统一转成纯文本的合规审核员,便于保留原始证据。
- 维护本地 LLM 工作流的自动化工程师,希望按文件类型路由转换并输出状态清单。
- 处理客户资料包的交付顾问,要求批量转换并明确哪些文件成功、失败或跳过。