Agent Skills
返回列表
录屏就是 SOP

录屏就是 SOP

办公效率 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_a706bb76/xb202606。

技能介绍

解决的问题

团队在沉淀后台系统、桌面软件或网页工具的使用说明时,常面临视频培训资料难以直接变成可检索、可分发、可维护文档的问题。这个技能把一段屏幕录制视频转成结构化操作说明书,并输出 HTML、Markdown 和 PDF 三种格式,适合用于版本发布、新人培训、客服支持和运维交接。

技能如何工作

整体流程分四步。第一步通过 scripts/extract_frames.py 提取关键帧,使用 --interval 控制最小采样间隔,使用 --threshold 控制场景变化敏感度,生成 frames_output/ 目录和 keyframes_meta.json。第二步通过 scripts/ocr_frames.py 做界面文字识别,使用 RapidOCR 输出每帧文字行、置信度和位置信息,用于还原菜单、按钮、字段、下拉项等界面元素。第三步按 references/sop_spec.md 的“八步法”撰写正文,覆盖版本记录、系统概述、前置条件、操作步骤、字段规则速查表、异常与边界情况、关联操作,并要求每个步骤包含用户动作和系统反馈。第四步生成多格式文档:HTML 使用左侧 sticky 目录和章节锚点,Markdown 使用标准 TOC、表格和块引用,PDF 由 scripts/md_to_pdf.py 生成,支持中文字体检测、页眉页脚、页边距和表格跨页重复表头。

适用边界与注意点

它更适合界面文字清晰、操作路径明确的录屏;对无界面文本、语音讲解为主或复杂动画视频,效果依赖 OCR 质量。Windows 下注意固定 onnxruntime==1.20.0,PDF 需要系统中存在中文字体。三种输出格式互相独立,修改其中一种不会自动同步其他格式。

使用场景

  • 把后台系统录屏培训转成带目录和截图引用的 HTML 操作说明
  • 从软件操作视频中提取字段标签和按钮文字,整理成字段规则速查表
  • 将网页操作录屏生成 Markdown 与 PDF,用于客服支持文档归档
  • 把发布前功能演示视频转成含异常处理和操作步骤的 SOP 文档

适合人员

  • 要把录屏培训沉淀成可检索操作说明的产品运营
  • 需要把新功能演示视频整理成 SOP 的客服或实施工程师
  • 要将后台系统操作路径文档化的技术支持人员
  • 负责发布文档并需输出 HTML、Markdown 和 PDF 的内容编辑